Latent Reward Steering: An Adaptive Inference-Time Framework that Implicitly Promotes Cognitive Behaviors in Reasoning LLMs
潜在奖励引导:一种自适应推理时框架,隐式促进推理大语言模型中的认知行为
Jiakang Li, Guanyu Zhu, Can Jin, Chenxi Huang, Dexu Yu, Ronghao Chen, Yang Zhou, Hongwu Peng, Xuanqi Lan, Dimitris N. Metaxas, Youhua Li
机构
*
Rutgers University(罗格斯大学)
;
South China Agricultural University(华南农业大学)
;
Columbia University(哥伦比亚大学)
;
Fenz.AI
;
QuantaAlpha
;
Adobe
;
Santa Clara University(圣克拉拉大学)
;
City University of Hong Kong(香港城市大学)