Ensuring Safe and High-Quality Outputs: A Guideline Library Approach for Language Models
Yi Luo, Zhenghao Lin, Yuhao Zhang, Jiashuo Sun, Chen Lin, Chengjin Xu, Xiangdong Su, Yelong Shen, Jian Guo, Yeyun Gong
机构
*
XiaMen University(厦门大学)
;
Yanshan University(雁山大学)
;
IDEA Research(IDEA研究)
;
Inner Mongolia University(内蒙古大学)
;
Microsoft(微软)
;
Microsoft Research Asia(微软亚洲研究院)
专题命中
指令微调
:language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI
CommentsAccepted to NAACL 2024 main conference
Journal refProceedings of the 2024 Conference of the North American Chapter of the Association for Computational Linguistics: Human Language Technologies (Volume 1: Long Papers)
Don't Half-listen: Capturing Key-part Information in Continual Instruction Tuning
Yongquan He, Wenyuan Zhang, Xuancheng Huang, Peng Zhang, Lingxun Meng, Xiang Zhou, Ke Zeng, Xunliang Cai
机构
*
School of Cyber Science and Engineering Nanjing University of Science and Technology China(南京理工大学信息科学与工程学院)
;
Meituan China(美团)
;
Zhipu.AI China(智谱AI)
;
Institute of Information Engineering Chinese Academy of Sciences China(中国科学院信息工程研究所)
专题命中
指令微调
:instruction tuning(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
Toward Effective Reinforcement Learning Fine-Tuning for Medical VQA in Vision-Language Models
Wenhui Zhu, Xuanzhao Dong, Xin Li, Peijie Qiu, Xiwen Chen, Abolfazl Razi, Aris Sotiras, Yi Su, Yalin Wang
机构
*
Arizona State University(亚利桑那州立大学)
;
Clemson University(克莱姆森大学)
;
Washington University in St.Louis(华盛顿大学圣路易斯分校)
;
Banner Alzheimer’s Institute(Banner阿尔茨海默病研究所)
专题命中
指令微调
:language model(title,abstract);large language model(abstract);SFT(abstract);分类 cs.CL、cs.AI