LangMARL: Natural Language Multi-Agent Reinforcement Learning
LangMARL: 自然语言多智能体强化学习
机构 * Arizona State University(亚利桑那州立大学) ; Cisco Research(思科研究院) ; University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校)
AI总结 LangMARL通过引入语言空间中的信用分配和策略梯度进化,解决大语言模型在动态环境中自主协调策略演化的问题,提升样本效率、可解释性和泛化能力。
Comments 20 pages, 12 figures