Agora: Collective and Permissionless Internet-Scale Pretraining of Large Language Models
Agora:大规模语言模型的集体无许可互联网规模预训练
专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);pretraining(title,abstract);分类 cs.LG
AI总结 研究旨在解决大语言模型训练资源受限问题,提出Agora系统,通过互联网级链路的带宽高效流水线并行模型分片与多方容错集体操作相结合,实现集体训练、集体所有模型,首次展示Pluralis - 8B预训练,效率达集中式基线63%。