Evolution Strategies at Scale: LLM Fine-Tuning Beyond Reinforcement Learning
大规模进化策略:超越强化学习的LLM微调
机构 * University of California, Los Angeles, Los Angeles, CA, USA(加州大学洛杉矶分校) ; Cognizant AI Lab, San Francisco, CA, USA(Cognizant AI实验室) ; The University of Texas at Austin, Austin, TX, USA(德克萨斯大学奥斯汀分校) ; Massachusetts Institute of Technology, Cambridge, MA, USA(麻省理工学院)
AI总结 本文提出使用进化策略进行大规模LLM微调,证明其在多个方面优于强化学习,为LLM微调提供了新的方法。
Comments Published at ICML 2026 main conference