ParamMem: Augmenting Language Agents with Parametric Reflective Memory
ParamMem: 通过参数化反思记忆增强语言代理
Tianjun Yao, Yongqiang Chen, Yujia Zheng, Pan Li, Zhiqiang Shen, Kun Zhang
机构
*
Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)
;
Carnegie Mellon University(卡内基梅隆大学)
;
Georgia Institute of Technology(佐治亚理工学院)
On the Generalization of SFT: A Reinforcement Learning Perspective with Reward Rectification
在SFT的泛化上:从强化学习视角的奖励校正
Yongliang Wu, Yizhou Zhou, Zhou Ziheng, Yingzhe Peng, Xinyu Ye, Xinting Hu, Wenbo Zhu, Lu Qi, Ming-Hsuan Yang, Xu Yang
机构
*
Southeast University(东南大学)
;
University of California, Los Angeles(加州大学洛杉矶分校)
;
Shanghai Jiao Tong University(上海交通大学)
;
Nanyang Technological University(南洋理工大学)
;
University of California, Berkeley(加州大学伯克利分校)
;
Wuhan University(武汉大学)
;
University of California, Merced(加州大学默塞德分校)