ReMix: Reinforcement routing for mixtures of LoRAs in LLM finetuning
ReMix:用于LoRAs混合的强化路由
机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) ; Meta AI ; Washington University St. Louis(华盛顿大学圣路易斯分校)
AI总结 ReMix通过引入不可学习的路由权重和强化学习技术,改进了混合LoRAs模型的路由机制,提升了模型的表达能力和微调效果。
Comments LLA @ ICLR 2026