Beyond Parameter Aggregation: Semantic Consensus for Federated Fine-Tuning of LLMs
超越参数聚合:联邦微调大语言模型的语义共识
Amr Abourayya, Jens Kleesiek, Michael Kamp
机构
*
Lamarr Institute for ML and AI, Technical University Dortmund(拉马尔机器学习与人工智能研究所,德意志理工大学)
;
Institute for AI in medicine (IKIM), University Hospital Essen(医学人工智能研究所(IKIM),埃森大学医院)
专题命中
指令微调
:LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);foundation model(abstract)
机构
*
Independent Researcher(独立研究者)
;
Centre for Applied Creative Technologies (CFACT+), Bournemouth University, UK(应用创意技术中心(CFACT+),伯恩茅斯大学,英国)
;
School of Computing, Newcastle University, Newcastle upon Tyne, UK(计算学院,新castle大学,新castle upon Tyne,英国)
专题命中
指令微调
:LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);prompting(abstract)
机构
*
Independent Researcher(独立研究者)
;
Department of Computer Science, University of Reading(阅读大学计算机科学系)
;
School of Computing, Newcastle University(新castle大学计算学院)
专题命中
指令微调
:LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);prompting(abstract)
Mind over Space: Can Multimodal Large Language Models Mentally Navigate?
心灵超越空间:多模态大语言模型能否进行心理导航?
Qihui Zhu, Shouwei Ruan, Xiao Yang, Hao Jiang, Yao Huang, Shiji Zhao, Hanwei Fan, Hang Su, Xingxing Wei
机构
*
Institute of Artificial Intelligence, Beihang University(北京航空航天大学人工智能研究院)
;
Dept. of Comp. Sci. and Tech., Institute for AI, Tsinghua-Bosch Joint ML Center, THBI Lab, BNRist Center, Tsinghua University(清华大学-博世联合机器学习中心、THBI实验室、BNRist中心、清华大学计算机科学与技术系)
;
School of Automation Science and Electrical Engineering , Beihang University(北京航空航天大学自动化科学与电气工程学院)
;
college of AI, Tsinghua University(清华大学人工智能学院)
;
Department of Computer Science and Technology , Tsinghua University(清华大学计算机科学与技术系)
专题命中
指令微调
:large language model(title);language model(title);分类 cs.AI
cadrille: Multi-modal CAD Reconstruction with Reinforcement Learning
cadrille: 多模态CAD重建与强化学习
Maksim Kolodiazhnyi, Denis Tarasov, Dmitrii Zhemchuzhnikov, Alexander Nikulin, Ilya Zisman, Anna Vorontsova, Anton Konushin, Vladislav Kurenkov, Danila Rukhovich
机构
*
Lomonosov Moscow State University(罗蒙诺索夫莫斯科国立大学)
;
AXXX
;
ETH Zurich(苏黎世联邦理工学院)
;
Innopolis University(因诺波利斯大学)
;
Institute of Mechanics, Armenia(亚美尼亚力学研究所)
专题命中
指令微调
:LLM(abstract);large language model(abstract);language model(abstract);SFT(abstract)
Playpen: An Environment for Exploring Learning Through Conversational Interaction
Nicola Horst, Davide Mazzaccara, Antonia Schmidt, Michael Sullivan, Filippo Momentè, Luca Franceschetti, Philipp Sadler, Sherzod Hakimov, Alberto Testoni, Raffaella Bernardi, Raquel Fernández, Alexander Koller, Oliver Lemon, David Schlangen, Mario Giulianelli, Alessandro Suglia
机构
*
University of Potsdam(波恩大学)
;
University of Trento(特伦特大学)
;
Saarland University(萨尔大学)
;
ETH Zurich(苏黎世联邦理工学院)
;
Amsterdam UMC(阿姆斯特丹医疗中心)
;
Free University of Bozen Bolzano(博兹纳自由大学)
;
University of Amsterdam(阿姆斯特丹大学)
;
Heriot-Watt University(赫里奥特-瓦特大学)
;
DFKI(德意志联邦研究所)
;
UCL(伦敦大学学院)
;
University of Edinburgh(爱丁堡大学)
专题命中
指令微调
:LLM(abstract);large language model(abstract);language model(abstract);post-training(abstract)
CommentsAccepted at EMNLP 2025 (Main) Source code: https://github.com/lm-playpen/playpen Please send correspodence to: lm-playschool@googlegroups.com