Wireless Federated Multi-Task LLM Fine-Tuning via Sparse-and-Orthogonal LoRA
通过稀疏和正交LoRA实现无线联邦多任务大语言模型微调
Nuocheng Yang, Sihua Wang, Ouwen Huan, Mingzhe Chen, Tony Q. S. Quek, Changchuan Yin
机构
*
Beijing Laboratory of Advanced Information Network(北京先进信息网络实验室)
;
Beijing Key Laboratory of Network System Architecture and Convergence(北京网络系统架构与融合重点实验室)
;
Beijing University of Posts and Telecommunications(北京邮电大学)
;
Department of Electrical and Computer Engineering and Institute for Data Science and Computing(电气与计算机工程系和数据科学与计算研究所)
;
University of Miami(迈阿密大学)
;
Information Systems Technology and Design Pillar(信息系统技术与设计支柱)
专题命中
指令微调
:LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)
On the Effectiveness of LLM-Specific Fine-Tuning for Detecting AI-Generated Text
针对检测AI生成文本的LLM特定微调效果研究
Michał Gromadzki, Anna Wróblewska, Agnieszka Kaliska
机构
*
Faculty of Mathematics and Information Science, Warsaw University of Technology(华沙技术大学数学与信息科学学院)
;
Faculty of Modern Languages and Literatures, Adam Mickiewicz University(亚当·密茨凯维奇大学现代语言与文学学院)
专题命中
指令微调
:LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)
Investigating the Multilingual Calibration Effects of Language Model Instruction-Tuning
探究语言模型指令微调的多语言校准效应
Jerry Huang, Peng Lu, Qiuhao Zeng, Yusuke Iwasawa, Yutaka Matsuo, Sarath Chandar, Edison Marrese-Taylor, Irene Li
机构
*
Mila - Quebec AI Institute(魁北克人工智能研究所)
;
Université de Montréal(蒙特利尔大学)
;
The University of Tokyo(东京大学)
;
Western University(西方大学)
;
Vector Institute(向量研究所)
;
Polytechnique Montréal(蒙特利尔理工学院)
;
CIFAR AI Chair(CIFAR人工智能主席)
;
AIST(日本产业技术综合研究所)
专题命中
指令微调
:language model(title,abstract);large language model(abstract);foundation model(abstract);SFT(abstract)
机构
*
Department of Computer Engineering and Digital Technology, Faculty of Engineering, Chulalongkorn University(朱拉隆梭大学工程学院计算机工程与数字技术系)
;
Faculty of Engineering, Thammasat School of Engineering, Thammasat University(泰国 Thammasat 大学工程学院)
;
Artificial Intelligence Association of Thailand(泰国人工智能协会)
;
School of Biomedical Engineering & Imaging Sciences, King’s College London(伦敦国王学院生物医学工程与成像科学学院)
;
Siriraj Informatics and Data Innovation Center (SIData+), Faculty of Medicine, Siriraj Hospital, Mahidol University(玛希诺大学医学学院西里拉医院信息与数据创新中心(SIData+))
专题命中
指令微调
:LLM(title);large language model(abstract);language model(abstract);SFT(abstract)
Calibrated Language Models and How to Find Them with Label Smoothing
Jerry Huang, Peng Lu, Qiuhao Zeng
专题命中
指令微调
:language model(title,abstract);large language model(abstract);instruction tuning(abstract);SFT(abstract)
CommentsAccepted to the Forty-second International Conference on Machine Learning (ICML) 2025. First two authors contributed equally. Official proceedings version available at https://proceedings.mlr.press/v267/huang25w.html
Leveraging What's Overfixed: Post-Correction via LLM Grammatical Error Overcorrection
Taehee Park, Heejin Do, Gary Geunbae Lee
机构
*
Graduate School of Artificial Intelligence, POSTECH, South Korea(POSTECH人工智能研究生院)
;
ETH Zurich, ETH AI Center(苏黎世联邦理工学院人工智能中心)
;
Department of Computer Science and Engineering, POSTECH, South Korea(POSTECH计算机科学与工程系)
专题命中
指令微调
:LLM(title,abstract);large language model(abstract);language model(abstract);small language model(abstract)
机构
*
University of California, San Diego(加州大学圣地亚哥分校)
;
Adobe Research(Adobe研究)
;
The University of New South Wales(新南威尔士大学)
;
CSIRO’s Data61(澳大利亚联邦科学与工业研究组织的数据61)
专题命中
指令微调
:instruction tuning(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)