Controllable LLM Reasoning via Sparse Autoencoder-Based Steering
通过稀疏自编码器基于的转向实现可控的大语言模型推理
机构 * University of Science and Technology of China(中国科学技术大学) ; Zhongguancun Academy(中关村学院) ; Alibaba Group(阿里巴巴集团) ; Tsinghua University(清华大学)
AI总结 本文提出SAE-Steering方法,通过稀疏自编码器分解隐藏状态,实现对大语言模型推理策略的高效控制,提升推理准确率和灵活性。
Comments Accepted to the ACL 2026 Main