Learning to Select, Not Relearn: Hard-Routed Mixtures of Reasoning LoRAs
学会选择,而非重新学习:硬路由推理LoRA混合
机构 * Halmstad University(哈尔姆斯塔德大学) ; The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))
专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG
AI总结 提出硬路由MoR-LoRA框架,通过硬top-1路由组合冻结的推理LoRA专家,保留专家行为且可训练参数少于软路由方法。
Comments Code available at: https://github.com/sar-molavi/hard-routed-mor-lora