Reinforcement Learning Improves Traversal of Parametric Knowledge in LLMs
强化学习改善LLM中参数化知识的遍历
机构 * Carnegie Mellon University(卡内基梅隆大学) ; MIT(麻省理工学院) ; Stanford University(斯坦福大学)
专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI
AI总结 本文发现强化学习提升LLM知识回忆能力,原因在于改进了模型对参数化知识层次结构的遍历技能,而非获取新知识。
Comments `