Cooperative Coevolution for Resource-Constrained Agentic LLM Post-Training
资源受限智能体大语言模型后训练的协同协同进化方法
专题命中 后训练与偏好优化 :LLM(title,summary_cn);post-training(title,abstract);large language model(abstract);language model(abstract)
AI总结 针对资源受限智能体LLM后训练的高内存、长耗时问题,提出CoPES方法,在GPU小时预算下,其验证准确率恢复率、内存效率均优于标准ES和LoRA-GRPO,在多任务基准上表现更优。
Comments 14 pages,9 figures, submit to AAAI 2027