$\nabla$-Reasoner: LLM Reasoning via Test-Time Gradient Descent in Latent Space
∇-Reasoner: 通过潜在空间中的测试时间梯度下降进行LLM推理
机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校) ; UC San Diego(圣地亚哥大学) ; TTIC ; Georgia Tech(佐治亚理工学院)
专题命中 测试时计算 :reasoning(title,abstract);分类 cs.LG
AI总结 ∇-Reasoner通过潜在空间中的测试时间梯度下降提升LLM推理能力,实现20%以上的准确率提升并减少模型调用次数。
Comments ICLR 2026