How Can We Synthesize High-Quality Pretraining Data? A Systematic Study of Prompt Design, Generator Model, and Source Data
如何合成高质量的预训练数据?提示设计、生成模型和源数据的系统研究
Joel Niklaus, Atsuki Yamaguchi, Michal Štefánik, Guilherme Penedo, Hynek Kydlíček, Elie Bakouch, Lewis Tunstall, Edward Emanuel Beeching, Thibaud Frere, Colin Raffel, Leandro von Werra, Thomas Wolf
机构
*
Hugging Face
;
University of Sheffield(谢菲尔德大学)
;
National Institute of Informatics(日本信息处理研究所)
TokSuite: Measuring the Impact of Tokenizer Choice on Language Model Behavior
TokSuite:衡量分词器选择对语言模型行为的影响
Gül Sena Altıntaş, Malikeh Ehghaghi, Brian Lester, Fengyuan Liu, Wanru Zhao, Marco Ciccone, Colin Raffel
机构
*
University of Toronto(多伦多大学)
;
Vector Institute(向量研究所)
;
Google DeepMind(谷歌DeepMind)
;
McGill University(麦吉尔大学)
;
University of Cambridge(剑桥大学)
;
Hugging Face
SARLO-80: Worldwide Slant SAR Language Optic Dataset 80cm
SARLO-80:全球斜距SAR语言光学数据集80cm
Solène Debuysère, Nicolas Trouvé, Nathan Letheule, Elise Colin, Georgia Channing
机构
*
DEMR-ONERA – The French Aerospace Lab, Université Paris-Saclay(法国航空航天实验室DEMR-ONERA,巴黎-萨克雷大学)
;
DTIS-ONERA – The French Aerospace Lab, Université Paris-Saclay(法国航空航天实验室DTIS-ONERA,巴黎-萨克雷大学)
;
Hugging Face
Every Eval Ever: A Unifying Schema and Community Repository for AI Evaluation Results
Every Eval Ever:AI评估结果的统一模式与社区仓库
Jan Batzner, Sree Harsha Nelaturu, Damian Stachura, Anastassia Kornilova, Jon Crall, Tommaso Cerruti, Yanan Long, Yifan Mai, Sanchit Ahuja, Asaf Yehudai, Marek Šuppa, John P. Lalor, Oluwagbemike Olowe, Jatin Ganhotra, Brian H. Hu, Eliya Habba, Andrew M. Bean, Chang Liu, Sander Land, Steven Dillmann, Aniketh Garikaparthi, Elron Bandel, Saki Imai, James Edgell, Wm. Matthew Kennedy, Jenny Chim, Patrick Meusling, Asteria Kaeberlein, Venkata Ramachandra Karthik Chundi, Manasi Patwardhan, Martin Ku, Austin Meek, Leon Knauer, Brian Wingenroth, Srishti Yadav, Usman Gohar, Felix Friedrich, Michelle Lin, Jennifer Mickel, Arman Cohan, Stella Biderman, Irene Solaiman, Zeerak Talat, Anka Reuel, Mubashara Akhtar, Gjergji Kasneci, Avijit Ghosh, Leshem Choshen
机构
*
Technical University Munich(慕尼黑工业大学)
;
Munich Center for Machine Learning(慕尼黑机器学习中心)
;
Weizenbaum Institute(魏岑鲍姆研究所)
;
Zuse Institute Berlin(柏林祖泽研究所)
;
Evidence Prime
;
Trustible
;
Kitware
;
ETH Zurich(苏黎世联邦理工学院)
;
StickFlux Labs
;
Stanford University(斯坦福大学)
;
Northeastern University(东北大学)
;
IBM Research(IBM研究院)
;
Comenius University Bratislava(布拉迪斯拉发夸美纽斯大学)
;
Cisco(思科)
;
University of Notre Dame(圣母大学)
;
Hebrew University of Jerusalem(耶路撒冷希伯来大学)
;
University of Oxford(牛津大学)
;
Ohio University(俄亥俄大学)
;
Writer
;
TCS Research(塔塔咨询服务研究院)
;
Oxford University Press(牛津大学出版社)
;
Queen Mary University of London(伦敦玛丽女王大学)
;
Technical University Berlin(柏林工业大学)
;
University of Delaware(特拉华大学)
;
Cinemo
;
Johns Hopkins University(约翰霍普金斯大学)
;
University of Copenhagen(哥本哈根大学)
;
ELLIS(欧洲学习与智能系统实验室)
;
Iowa State University(爱荷华州立大学)
;
Meta FAIR
;
University of Montreal(蒙特利尔大学)
;
Mila Quebec AI Institute(Mila魁北克人工智能研究所)
;
EleutherAI
;
Yale University(耶鲁大学)
;
Hugging Face
;
University of Edinburgh(爱丁堡大学)
;
Harvard University(哈佛大学)
;
ETH AI Center(ETH人工智能中心)
;
MIT(麻省理工学院)
;
MIT-IBM Watson Lab(MIT-IBM沃森实验室)
Evaluation Cards: An Interpretive Layer for AI Evaluation Reporting
评估卡:AI评估报告的解释层
Avijit Ghosh, Anka Reuel, Jenny Chim, Wm. Matthew Kennedy, Srishti Yadav, Jennifer Mickel, Yanan Long, Andrew Tran, Anastassia Kornilova, Damian Stachura, Kevin Klyman, Felix Friedrich, Jeba Sania, Jan Batzner, Anoop Mishra, Eliya Habba, Yixiong Hao, Nathan Heath, Shalaleh Rismani, Usman Gohar, Andrea Loehr, David Manheim, Ruchira Dhar, Sree Harsha Nelaturu, Aarush Sinha, Leshem Choshen, Drishti Sharma, Ishan Khire, Amit Saha, Subramanyam Sahoo, Michael Hardy, Michael Alexander Riegler, Kabir Manghnani, Michelle Lin, Yanan Jiang, Yilin Huang, Asaf Yehudai, Jessica Ji, Aris Hofmann, Mubashara Akhtar, Max Lamparth, Nuno Moniz, Yacine Jernite, Stella Biderman, Zeerak Talat, Sanmi Koyejo, Mykel Kochenderfer, Irene Solaiman
机构
*
Hugging Face
;
Stanford University(斯坦福大学)
;
Queen Mary University of London(伦敦玛丽女王大学)
;
University of Copenhagen(哥本哈根大学)
;
Trustible
;
EleutherAI
;
TU Darmstadt(达姆施塔特工业大学)
;
Weizenbaum Institute & Technical University of Munich(魏森鲍姆研究所与慕尼黑工业大学)
;
Harvard University(哈佛大学)
;
The Hebrew University of Jerusalem(耶路撒冷希伯来大学)
;
Iowa State University(爱荷华州立大学)
;
IBM Research(IBM研究院)
;
University of Chicago(芝加哥大学)
;
Independent(独立)
;
Berkeley AI Safety Institute (BASIS)(伯克利人工智能安全研究所)
;
Simula
;
University of Edinburgh(爱丁堡大学)
;
ETH Zurich & ETH AI Center(苏黎世联邦理工学院与ETH AI中心)
;
Oxford Internet Institute(牛津互联网研究所)
;
Amherst College(阿默斯特学院)
;
University of Nebraska(内布拉斯加大学)
;
Syntony Research
;
McGill University(麦吉尔大学)
;
Evals Consensus
;
Israel Institute of Technology(以色列理工学院)
;
IOL.Learn & Zuse Institute Berlin(IOL.Learn与柏林祖泽研究所)
;
Georgia Institute of Technology(佐治亚理工学院)
;
Quebec AI Institute, Université de Montréal(魁北克人工智能研究所,蒙特利尔大学)
;
University of Notre Dame(圣母大学)
;
Georgetown University(乔治城大学)
;
DHBW Stuttgart(斯图加特双元制大学)
;
Massachusetts Institute of Technology(麻省理工学院)
机构
*
University of Washington Seattle(华盛顿大学(西雅图))
;
Salesforce Research(Salesforce研究)
;
Microsoft(微软)
;
Hugging Face and University of Connecticut(Hugging Face与康涅狄格大学)
La Leaderboard: A Large Language Model Leaderboard for Spanish Varieties and Languages of Spain and Latin America
La Leaderboard:一种用于西班牙及拉丁美洲各种语言和方言的大型语言模型排行榜
María Grandury, Javier Aula-Blasco, Júlia Falcão, Clémentine Fourrier, Miguel González, Gonzalo Martínez, Gonzalo Santamaría, Rodrigo Agerri, Nuria Aldama, Luis Chiruzzo, Javier Conde, Helena Gómez, Marta Guerrero, Guido Ivetta, Natalia López, Flor Miriam Plaza-del-Arco, María Teresa Martín-Valdivia, Helena Montoro, Carmen Muñoz, Pedro Reviriego, Leire Rosado, Alejandro Vaca, María Estrella Vallecillo-Rodríguez, Jorge Vallego, Irune Zubiaga
机构
*
SomosNLP
;
ETSIT, Universidad Politécnica de Madrid(ETSIT,西班牙马德里理工大学)
;
Barcelona Supercomputing Center(巴塞罗那超级计算中心)
;
Hugging Face
;
Universidad Carlos III de Madrid(马德里卡洛斯三世大学)
;
Instituto de Ingeniería del Conocimiento(知识工程研究所)
;
Centro HiTZ - Ixa, Universidad del País Vasco UPV/EHU(HiTZ-Ixa中心,巴斯克大学)
;
LIACS, Leiden University(LIACS,莱顿大学)
;
Universidad de Jaén(杰嫩大学)
;
Universidad Nacional de Córdoba(科尔多瓦国立大学)
;
Universidad Nacional Autónoma de México(墨西哥国立自治大学)
;
Universidad de la República, Uruguay(乌拉圭共和国大学)
AI总结
La Leaderboard是一个开源项目,旨在评估西班牙及拉丁美洲各种语言和方言的生成式大型语言模型,通过社区驱动的方式促进多样化语言模型的发展。
Factuality Matters: When Image Generation and Editing Meet Structured Visuals
事实性至关重要:当图像生成与编辑遇见结构化视觉
Le Zhuo, Songhao Han, Yuandong Pu, Boxiang Qiu, Sayak Paul, Yue Liao, Yihao Liu, Jie Shao, Xi Chen, Si Liu, Hongsheng Li
机构
*
CUHK MMLab(香港大学多模态实验室)
;
Beihang University(北京航空航天大学)
;
Krea AI(Krea人工智能)
;
Shanghai Jiao Tong University(上海交通大学)
;
Shanghai AI Lab(上海人工智能实验室)
;
Hugging Face
;
National University of Singapore(新加坡国立大学)
;
ByteDance(字节跳动)
;
The University of Hong Kong(香港大学)
LeRobot: An Open-Source Library for End-to-End Robot Learning
LeRobot:端到端机器人学习的开源库
Remi Cadene, Simon Aliberts, Francesco Capuano, Michel Aractingi, Adil Zouitine, Pepijn Kooijmans, Jade Choghari, Martino Russi, Caroline Pascal, Steven Palma, Mustafa Shukor, Jess Moss, Alexander Soare, Dana Aubakirova, Quentin Lhoest, Quentin Gallouédec, Thomas Wolf
TAROT: Test-driven and Capability-adaptive Curriculum Reinforcement Fine-tuning for Code Generation with Large Language Models
TAROT: 为基于大语言模型的代码生成设计的测试驱动和能力适应课程强化微调
Chansung Park, Juyong Jiang, Fan Wang, Sayak Paul, Jiasi Shen, Jing Tang, Jianguo Li
机构
*
Electronics and Telecommunications Research Institute(电信研究所)
;
The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
;
The Hong Kong University of Science and Technology(香港科技大学)
;
Hugging Face
;
Ant Group(蚂蚁集团)