Asynchronous RLHF: Faster and More Efficient Off-Policy RL for Language Models
Michael Noukhovitch, Shengyi Huang, Sophie Xhonneux, Arian Hosseini, Rishabh Agarwal, Aaron Courville
机构
*
Mila Quebec AI Institute(魁北克AI研究所)
;
Université de Montréal(蒙特利尔大学)
;
Allen Institute for AI(人工智能研究院)
;
Google Deepmind(谷歌DeepMind)
;
Canada CIFAR AI Chair(加拿大CIFAR人工智能主席)
专题命中
后训练与偏好优化
:RLHF(title,abstract);language model(title,abstract);LLM(abstract);large language model(abstract)
When Lower Privileges Suffice: Investigating Over-Privileged Tool Selection in LLM Agents
当较低权限足够时:探究LLM代理中的过度权限工具选择
Kaiyue Yang, Yuyan Bu, Jingwei Yi, Yuchi Wang, Biyu Zhou, Juntao Dai, Songlin Hu, Yaodong Yang
机构
*
Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所)
;
Beijing Academy of Artificial Intelligence(北京人工智能研究院)
;
The Chinese University of Hong Kong(香港中文大学)
;
Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院)
;
School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络安全学院)
Efficient Preference Poisoning Attack on Offline RLHF
高效偏好投毒攻击离线RLHF
Chenye Yang, Weiyu Xu, Lifeng Lai
机构
*
Department of Electrical and Computer Engineering, University of California, Davis, Davis, CA, USA(加州大学戴维斯分校电气与计算机工程系)
;
Department of Electrical and Computer Engineering, University of Iowa, Iowa City, IA, USA(爱荷华大学电气与计算机工程系)
Controllable Spoken Dialogue Generation: An LLM-Driven Grading System for K-12 Non-Native English Learners
可控的口语对话生成:一种基于LLM的评分系统用于K-12非母语英语学习者
Haidong Yuan, Haokun Zhao, Wanshi Xu, Songjun Cao, Qingyu Zhou, Long Ma, Hongjie Fan
机构
*
Peking University(北京大学)
;
Tencent(腾讯)
;
China University of Political Science and Law(中国政法大学)
;
Independent Researcher(独立研究者)
;
Fudan University(复旦大学)
专题命中
后训练与偏好优化
:LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
An Engineering Journey Training Large Language Models at Scale on Alps: The Apertus Experience
在Alps上规模化训练大型语言模型的工程之旅:Apertus经验
Jonathan Coles, Stefano Schuppli, Lukas Drescher, Fawzi Roberto Mohamed, Elia Palme, Henrique Mendonça, Miguel Gila, Mark Klein, Maxime Martinasso, Joost VandeVondele, Torsten Hoefler, Thomas Schulthess, Josh Romero, Igor Gorodetsky, Ryan Hankins, Isa Wazirzada, Martin Jaggi, Antoine Bosselut, Imanol Schlag, Antoni-Joan Solergibert i Llaquet, Alejandro Hernández Cano, Theofilos Ioannis Manitaras, Nicholas John Browning
专题命中
后训练与偏好优化
:large language model(title,abstract);language model(title,abstract);foundation model(abstract);post-training(abstract)