机构
*
China University of Petroleum (East China)(中国石油大学(华东))
;
Shanghai Jiao Tong University(上海交通大学)
;
Wuhan University(武汉大学)
;
Great Wall Motor(长城汽车)
;
Nanyang Technological University(南洋理工大学)
;
The University of Hong Kong(香港大学)
专题命中
指令微调
:LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);foundation model(abstract)
PACT: Privileged Trace Co-Training for Multi-Turn Tool-Use Agents
PACT: 多轮工具使用智能体的特权轨迹协同训练
Zhenbang Du, Jun Luo, Zhiwei Zheng, Xiangchi Yuan, Kejing Xia, Dachuan Shi, Qirui Jin, Qijia He, Shaofeng Zou, Yingbin Liang, Wenke Lee
机构
*
Georgia Institute of Technology(佐治亚理工学院)
;
Ohio State University(俄亥俄州立大学)
;
University of Pennsylvania(宾夕法尼亚大学)
;
Arizona State University(亚利桑那州立大学)
CapRL++: Unified Reinforcement Learning with Verifiable Rewards for Dense Image and Video Captioning
CapRL++:基于可验证奖励的统一强化学习用于密集图像和视频描述生成
Penghui Yang, Long Xing, Xiaoyi Dong, Yuhang Zang, Yuhang Cao, Yibin Wang, Yujie Zhou, Jiazi Bu, Jianze Liang, Qidong Huang, Jiaqi Wang, Feng Wu, Dahua Lin
机构
*
Tsinghua University(清华大学)
;
University of Science and Technology of China(中国科学技术大学)
;
Microsoft(微软)
;
Shanghai AI Laboratory(上海人工智能实验室)
;
Shanghai Innovation Institute(上海创新研究院)
;
Alibaba Cloud(阿里云)
;
The Chinese University of Hong Kong(香港中文大学)
Rethinking Heterogeneous LLM Merging: A Weighted Model Averaging Perspective
重新思考异构语言模型合并:加权模型平均视角
Jiahe Fan, Yinghao Hou, Si Chen, Aiyuan Zhang, Hong Xie, Defu Lian
机构
*
University of Science and Technology of China(中国科学技术大学)
;
School of Computer Science and Technology, University of Science and Technology of China(中国科学技术大学计算机科学与技术学院)
专题命中
指令微调
:LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI