Skill Weaving: Efficient LLM Improvement via Modular Skillpacks
技能编织:通过模块化技能包实现高效的LLM改进
Zhuo Li, Guodong Du, Zesheng Shi, Weiyang Guo, Weijun Yao, Yuan Zhou, Jiabo Zhang, Jing Li
机构
*
Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学(深圳))
;
The Hong Kong Polytechnic University(香港理工大学)
;
Huawei Technologies Co., Ltd.(华为技术有限公司)
;
Shanghai Jiaotong University(上海交通大学)
专题命中
效率与部署
:LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG
LABO: LLM-Accelerated Bayesian Optimization through Broad Exploration and Selective Experimentation
LABO: 通过广泛探索和选择性实验实现的LLM加速贝叶斯优化
Zhuo Chen, Xinzhe Yuan, Jianshu Zhang, Jinzong Dong, Ruichen Zhou, Yingchun Niu, Tianhang Zhou, Yu Yang Fredrik Liu, Yuqiang Li, Nanyang Ye, Qinying Gu
机构
*
Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
;
School of Mechanical Engineering, Shanghai Jiao Tong University(上海交通大学机械工程学院)
;
Institute for Advanced Study in Mathematics, Harbin Institute of Technology(哈尔滨工业大学数学研究所)
;
School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学学院)
;
School of Automation, Central South University(中南大学自动化学院)
;
College of New Energy and Materials, China University of Petroleum, Beijing(中国石油大学(北京)新能源与材料学院)
;
College of Carbon Neutrality Future Technology, China University of Petroleum, Beijing(中国石油大学(北京)碳中和未来技术学院)
;
DeepVerse PTE. LTD.
专题命中
效率与部署
:LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG
GraphFlow: A Graph-Based Workflow Management for Efficient LLM-Agent Serving
GraphFlow: 一种基于图的流程管理用于高效的LLM代理服务
Ao Li, Shangpeng Yang, Fahao Chen, Tianheng Xu, Peng Li, Zhou Su
机构
*
School of Cyber Science and Engineering, Xi'an Jiaotong University, Xi'an, China(西安交通大学计算机科学与工程学院)
;
School of Artificial Intelligence, Shandong University, Jinan, China(山东大学人工智能学院)
;
Shanghai Advanced Research Institute, Chinese Academy of Sciences, Shanghai, China(中国科学院上海先进研究院)
专题命中
效率与部署
:LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.LG
机构
*
School of Computing and Artificial Intelligence, Southwest Jiaotong University(计算机与人工智能学院,西南交通大学)
;
Shenzhen Institute for Advanced Study, University of Electronic Science and Technology of China(深圳先进研究院,电子科技大学)
;
School of Computer Science and Engineering, Northeastern University(计算机科学与工程学院,东北大学)
专题命中
效率与部署
:LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.LG
机构
*
Georgia Institute of Technology(佐治亚理工学院)
;
University of California, Los Angeles(加州大学洛杉矶分校)
;
Carnegie Mellon University(卡内基梅隆大学)
;
William & Mary(威廉与玛丽大学)
专题命中
效率与部署
:large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);分类 cs.CL、cs.AI、cs.LG
机构
*
National Key Laboratory for Novel Software Technology, Nanjing University(南京大学新型软件技术国家重点实验室)
;
School of Intelligent Science and Technology, Nanjing University(南京大学智能科学与技术学院)
;
School of Artificial Intelligence, Nanjing University(南京大学人工智能学院)
;
Microsoft AI(微软AI)
专题命中
效率与部署
:large language model(title,abstract);language model(title,abstract);LLM(abstract_cn);分类 cs.AI、cs.LG
Steins;Gate Drive: Semantic Safety Arbitration over Structured Futures for Latency-Decoupled LLM Planning
Steins;Gate Drive: 基于结构化未来语义安全仲裁的延迟解耦LLM规划
Anjie Qiu, Hans D. Schotten
机构
*
Institute for Wireless Communication and Navigation(无线通信与导航研究所)
;
RPTU University Kaiserslautern-Landau(凯撒斯劳滕-兰道大学)
;
German Research Center for Artificial Intelligence(德国人工智能研究中心)
SpaceMoE: Realizing Distributed Mixture-of-Experts Inference over Space Networks
SpaceMoE:在空间网络上实现分布式混合专家推理
Zhanwei Wang, Huiling Yang, Min Sheng, Khaled B. Letaief, Kaibin Huang
机构
*
Department of Electrical and Computer Engineering, The University of Hong Kong (HKU)(香港大学电子与计算机工程系)
;
State Key Laboratory of Integrated Service Networks, Institute of Information Science, Xidian University(西安电子科技大学信息科学学院集成服务网络国家重点实验室)
;
Department of Electronic and Computer Engineering, The Hong Kong University of Science and Technology (HKUST)(香港科学与技术大学电子与计算机工程系)
专题命中
效率与部署
:LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI
Maestro: Reinforcement Learning to Orchestrate Hierarchical Model-Skill Ensembles
Maestro:通过强化学习协调分层模型-技能集合
Jinyang Wu, Guocheng Zhai, Ruihan Jin, Yuhao Shen, Zhengxi Lu, Fan Zhang, Haoran Luo, Zheng Lian, Zhengqi Wen, Jianhua Tao
机构
*
Tsinghua University(清华大学)
;
Zhejiang University(浙江大学)
;
The Chinese University of Hong Kong(香港中文大学)
;
Nanyang Technological University(南洋理工大学)
;
Tongji University(同济大学)
专题命中
效率与部署
:LLM(abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG
Accelerating Vision Foundation Models with Drop-in Depthwise Convolution
通过可插拔的深度卷积加速视觉基础模型
Carmelo Scribano, Mohammad Mahdi, Nedyalko Prisadnikov, Yuqian Fu, Giorgia Franchini, Danda Pani Paudel, Marko Bertogna, Luc Van Gool
机构
*
University of Modena and Reggio Emilia(摩德纳和雷吉奥艾米利亚大学)
;
INSAIT, Sofia University ``St. Kliment Ohridski'', Sofia, Bulgaria(INSAIT,索菲亚大学『圣克莱门特·欧赫里迪斯』,索菲亚,保加利亚)
Visual-Advantage On-Policy Distillation for Vision-Language Models
基于视觉优势的在线策略蒸馏用于视觉-语言模型
Ruiqi Liu, Xiaolei Lv, Gengsheng Li, Ximo Zhu, Zhiheng Wang, Zhengbo Zhang, Junkai Chen, Zhiheng Li, Bo Li, Jun Gao, Shu Wu
机构
*
Institute of Automation, CAS(中国科学院自动化研究所)
;
School of Advanced Interdisciplinary Sciences, UCAS(中国科学院大学(UCAS)先进交叉学科学院)
;
Hello Group Inc.(Hello集团有限公司)
;
Sun Yat-sen University(中山大学)