Learning to Seek Help: Dynamic Collaboration Between Small and Large Language Models
学习寻求帮助:小语言模型与大语言模型之间的动态协作
Hang Zeng, Xiangyu Liu, Yong Hu, Chaoyue Niu, Jiarui Zhang, Shaojie Tang, Fan Wu, Guihai Chen
机构
*
Shanghai Jiao Tong University, Shanghai, China(上海交通大学)
;
WeChat Tencent, Beijing, China(微信腾讯)
;
State University of New York at Buffalo, New York, United States(纽约州立大学布法罗分校)
专题命中
效率与部署
:large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);SLM(abstract,abstract_cn)
D-QRELO: Training- and Data-Free Delta Compression for Large Language Models via Quantization and Residual Low-Rank Approximation
D-QRELO:通过量化和残差低秩近似实现大型语言模型的训练和数据无关的delta压缩
Junlin Li, Shuangyong Song, Guodong Du, Ngai Wong, Xuebo Liu, Yongxiang Li, Min Zhang, Jing Li, Xuelong Li
机构
*
Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学(深圳))
;
TeleAI of China Telecom(中国电信TeleAI)
;
The Hong Kong Polytechnic University(香港理工大学)
;
The University of Hong Kong(香港大学)
专题命中
效率与部署
:large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);SFT(abstract,abstract_cn)
机构
*
The Chinese University of Hong Kong(香港中文大学)
;
Infinigence AI
;
Tsinghua University(清华大学)
;
SLAI
;
Shanghai Jiao Tong University(上海交通大学)
;
Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
专题命中
效率与部署
:language model(title,abstract);small language model(title,abstract);SLM(abstract,abstract_cn);分类 cs.CL、cs.AI、cs.LG
Han Xu, Xuerui Qiu, Baiyu Chen, Xinhao Luo, Xingrun Xing, Jiahong Zhang, Bo Lei, Tiejun Huang, Bo Xu, Guoqi Li
机构
*
Institute of Automation, Chinese Academy of Sciences, Beijing 100190, China
;
School of Artificial Intelligence, University of Chinese Academy of Sciences, Beijing 100049, China
;
Brain-Inspired Models Group, Beijing Academy of Artificial Intelligence, Beijing 100862, China
;
School of Future Technology, University of Chinese Academy of Sciences, Beijing 101408, China
;
Zhongguancun Academy, Beijing 100094, China
;
Pengcheng Laboratory, Guangdong 518055, China
;
School of Advanced Inter-disciplinary Sciences, University of Chinese Academy of Sciences, Beijing 101408, China
;
School of Computer Science, Peking University, Beijing 100871, China
;
Key Laboratory of Brain Cognition
;
Spiking Intelligence Lab, Tianqiao \& Chirssy Chen Institute, Shanghai 201203, China
专题命中
效率与部署
:large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);分类 cs.AI
Clinical Note Bloat Reduction for Efficient LLM Use
临床笔记去冗余以提高大语言模型使用效率
Jordan L. Cahoon, Chloe Stanwyck, Asad Aali, Rachel Madding, Emma Sun, Yixing Jiang, Renumathy Dhanasekaran, Emily Alsentzer
机构
*
Department of Biomedical Data Science, Stanford University, Stanford, CA(斯坦福大学生物医学数据科学系)
;
Department of Pathology, Stanford University, Stanford, CA(斯坦福大学病理学系)
;
Department of Anesthesiology, Perioperative and Pain Medicine, Stanford University, Stanford, CA(斯坦福大学麻醉学、围术期医学与疼痛医学系)
;
Department of Radiology, Stanford University, Stanford, CA(斯坦福大学放射学系)
;
Department of Obstetrics and Gynecology, Stanford University, Stanford, CA(斯坦福大学妇产科学系)
;
Division of Gastroenterology and Hepatology, Stanford University, Stanford, CA(斯坦福大学消化内科与肝病学系)
;
Department of Computer Science, Stanford University, Stanford, CA(斯坦福大学计算机科学系)
;
Weill Cancer Hub West(韦尔癌症中心西区)
专题命中
效率与部署
:LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
Toward Zero-Egress Psychiatric AI: On-Device LLM Deployment for Privacy-Preserving Mental Health Decision Support
迈向零数据外溢的心理AI:设备端LLM部署用于隐私保护的心理健康决策支持
Eranga Bandara, Asanga Gunaratna, Ross Gore, Anita H. Clayton, Christopher K. Rhea, Sachini Rajapakse, Isurunima Kularathna, Sachin Shetty, Ravi Mukkamala, Xueping Liang, Preston Samuel, Atmaram Yarlagadda
机构
*
Old Dominion University(旧 Dominion 大学)
;
AI Motion Labs(AI Motion 实验室)
;
Department of Psychiatry and Neurobehavioral Sciences(精神病学与神经行为科学系)
;
University of Virginia School of Medicine(弗吉尼亚大学医学院)
;
Florida International University(佛罗里达国际大学)
;
Blanchfield Army Community Hospital(Blanchfield陆军社区医院)
;
McDonald Army Health Center(McDonald陆军医疗中心)
ReflexiCoder: Teaching Large Language Models to Self-Reflect on Generated Code and Self-Correct It via Reinforcement Learning
ReflexiCoder:通过强化学习教大语言模型自我反思和自我纠正生成的代码
Juyong Jiang, Jiasi Shen, Sunghun Kim, Kang Min Yoo, Jeonghoon Kim, Sungju Kim
机构
*
The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
;
The Hong Kong University of Science and Technology(香港科技大学)
;
Amazon AGI(亚马逊人工智慧实验室)
;
NAVER Cloud(NAVER云)
专题命中
效率与部署
:large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG