In-Context Reinforcement Learning for Tool Use in Large Language Models
上下文强化学习用于大型语言模型中的工具使用
机构 * National University of Singapore(新加坡国立大学) ; Salesforce AI Research(Salesforce AI研究) ; University of California Berkeley(加州大学伯克利分校) ; University of California, Santa Cruz(加州大学圣克ruz分校)
专题命中 工具调用 :tool use(title);tool-use(abstract);分类 cs.AI
AI总结 本文提出ICRL框架,通过强化学习无需微调即可实现大型语言模型的工具使用能力,实验显示其在推理和工具任务中表现优异。