FlexRank: Nested Low-Rank Knowledge Decomposition for Adaptive Model Deployment
FlexRank: 嵌套低秩知识分解用于自适应模型部署
机构 * University of California, Berkeley(加州大学伯克利分校)
专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.LG
AI总结 提出FlexRank方法,通过嵌套低秩权重分解和基于重要性的整合,从预训练模型中提取不同能力的子模型,实现“一次训练,随处部署”的自适应部署。
Comments Accepted at ICML 2026 (Spotlight)
Journal ref Proceedings of the 43rd International Conference on Machine Learning, PMLR, 2026