A Survey of Frontiers in LLM Reasoning: Inference Scaling, Learning to Reason, and Agentic Systems
大语言模型推理前沿的综述:推理扩展、学习推理与代理系统
机构 * Salesforce AI Research(Salesforce AI研究) ; National University of Singapore(国立新加坡大学) ; Nanyang Technological University(南洋理工大学) ; The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) ; A*STAR, Singapore(新加坡A*STAR)
专题命中 规划决策 :agentic(title,abstract);agent(abstract);multi-agent(abstract);分类 cs.AI、cs.CL
AI总结 本文综述了大语言模型推理的前沿方法,从推理阶段和架构两个维度分类,探讨了推理扩展到学习推理及代理系统的发展趋势,涵盖监督微调、强化学习等算法及代理工作流设计。
Comments 72 pages, 6 figures. Accepted to TMLR, with Survey Certification award