Can We Break LLMs Out of Self-Loops? Fine-Grained Reasoning Control with Activation Steering
我们能否使大语言模型摆脱自我循环?通过激活引导实现细粒度推理控制
机构 * UC San Diego(加州大学圣地亚哥分校) ; Adobe Research(Adobe研究院) ; University of New South Wales(新南威尔士大学)
专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI
AI总结 研究大语言模型推理过程不可控问题,提出SOPHIA方法,通过将推理轨迹视为潜在状态序列,构建引导向量库,在推理时进行干预,可检测并防止自我循环,提升推理质量。