Comments13 pages, including AAAI Paper Checklist. Accepted in Proceedings of the 20th International AAAI Conference on Web and Social Media (ICWSM 2026)
Towards Building Non-Fine-Tunable Foundation Models
构建不可微调的基础模型
Ziyao Wang, Nizhang Li, Pingzhi Li, Guoheng Sun, Tianlong Chen, Ang Li
机构
*
University of Maryland, College Park(马里兰大学 College Park 分校)
;
Macau University of Science and Technology(澳门科学技术大学)
;
The University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校)
专题命中
预训练与数据
:foundation model(title,abstract);large language model(abstract);language model(abstract);pretraining(abstract)
SongSage: A Large Musical Language Model with Lyric Generative Pre-training
SongSage:一种具有歌词生成预训练的大型音乐语言模型
Jiani Guo, Jiajia Li, Jie Wu, Zuchao Li, Yujiu Yang, Ping Wang
机构
*
School of Computer Science, Wuhan University(武汉大学计算机学院)
;
School of Information Management, Wuhan University(武汉大学信息管理学院)
;
Tsinghua University(清华大学)
;
School of Artificial Intelligence, Wuhan University(武汉大学人工智能学院)
专题命中
预训练与数据
:language model(title,abstract);large language model(abstract);pretraining(abstract);SFT(abstract)
Native Design Bias: Studying the Impact of English Nativeness on Language Model Performance
Manon Reusens, Philipp Borchert, Jochen De Weerdt, Bart Baesens
机构
*
Research Centre for Information Systems Engineering (LIRIS), KU Leuven(信息系统工程研究中心(LIRIS),库勒文大学)
;
IESEG School of Management(IESEG管理学院)
;
Department of Decision Analytics and Risk, University of Southampton(决策分析与风险系,南安普顿大学)
专题命中
预训练与数据
:language model(title,abstract);LLM(abstract);large language model(abstract);pretraining(abstract)
ADEPT: Continual Pretraining via Adaptive Expansion and Dynamic Decoupled Tuning
Jinyang Zhang, Yue Fang, Hongxin Ding, Weibin Liao, Muyang Ye, Xu Chu, Junfeng Zhao, Yasha Wang
机构
*
Key Laboratory of High Confidence Software Technologies, Ministry of Education(高可信软件技术重点实验室,教育部)
;
School of Computer Science, Peking University(北京大学计算机学院)
;
College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院)
专题命中
预训练与数据
:pretraining(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)