On the Theory of Continual Learning with Gradient Descent for Neural Networks
关于使用梯度下降法进行神经网络持续学习的理论
Hossein Taheri, Avishek Ghosh, Arya Mazumdar
机构
*
Department of Computer Science and Engineering, University of California, San Diego(加州大学圣地亚哥分校计算机科学与工程系)
;
Department of Computer Science and Engineering, IIT, Bombay(印度孟买理工学院计算机科学与工程系)
;
Halicioğlu Data Science Institute, University of California, San Diego(加州大学圣地亚哥分校Halicioğlu数据科学研究所)
The Landscape of Agentic Reinforcement Learning for LLMs: A Survey
代理强化学习用于大语言模型的景观:综述
Guibin Zhang, Hejia Geng, Xiaohang Yu, Zhenfei Yin, Zaibin Zhang, Zelin Tan, Heng Zhou, Zhongzhi Li, Xiangyuan Xue, Yijiang Li, Yifan Zhou, Yang Chen, Chen Zhang, Yutao Fan, Zihu Wang, Songtao Huang, Francisco Piedrahita-Velez, Yue Liao, Hongru Wang, Mengyue Yang, Heng Ji, Jun Wang, Shuicheng Yan, Philip Torr, Lei Bai
机构
*
University of Oxford(牛津大学)
;
Shanghai AI Laboratory(上海人工智能实验室)
;
National University of Singapore(新加坡国立大学)
;
University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
;
Brown University(布朗大学)
;
University College London(伦敦大学学院)
;
University of Science and Technology of China(中国科学技术大学)
;
Imperial College London(伦敦帝国学院)
;
Dalian University of Technology(大连理工大学)
;
Chinese Academy of Sciences(中国科学院)
;
The Chinese University of Hong Kong(香港中文大学)
;
University of Georgia(佐治亚大学)
;
University of California, San Diego(加州大学圣地亚哥分校)
;
University of California, Santa Barbara(加州大学圣塔芭芭拉分校)
;
University of Bristol(布里斯托大学)