Rationale-Guided Knowledge Distillation for Cross-Lingual Stance Detection
用于跨语言立场检测的基于理由引导的知识蒸馏
Qiuli Zhou, Jingyuan Yao, Shengeng Tang, Hongzhi Chen, Jun Tang, Richang Hong
机构
*
School of Foreign Studies, Hefei University of Technology(合肥工业大学外国语学院)
;
School of Computer Science and Information Engineering, Hefei University of Technology(合肥工业大学计算机与信息工程学院)
;
Hefei Institute of Technology(合肥学院)
Hanqing Zhu, Wenyan Cong, Zhizhou Sha, Sagnik Mukherjee, Xinyuan Song, David González-Martínez, Xiaoxia Wu, Yuandong Tian, Shiwei Liu, David Z. Pan, Zhangyang "Atlas" Wang
机构
*
The University of Texas at Austin(德克萨斯大学奥斯汀分校)
;
UIUC(伊利诺伊大学香槟分校)
;
Emory University(埃默里大学)
;
Together AI(联合人工智能公司)
;
Recursive Superintelligence Inc(递归超级智能公司)
;
ELLIS Institute Tübingen(图宾根埃利斯研究所)
Length Value Model: Scalable Value Pretraining for Token-Level Length Modeling
长度值模型:用于令牌级长度建模的可扩展值预训练
Zhen Zhang, Changyi Yang, Zijie Xia, Zhen Yang, Chengzhi Liu, Zhaotiao Weng, Yepeng Liu, Haobo Chen, Jin Pan, Chenyang Zhao, Yuheng Bu, Alkesh Patel, Zhe Gan, Xin Eric Wang
机构
*
University of California, Santa Barbara(加州大学圣巴巴拉分校)
;
Carnegie Mellon University(卡内基梅隆大学)
;
University of Wisconsin–Madison(威斯康星大学麦迪逊分校)
;
LMSYS Org(LMSYS组织)
;
Apple Inc.(苹果公司)
专题命中
其他推理
:reasoning(abstract);分类 cs.CL
AI总结
本文提出Length Value Model,通过令牌级建模实现高效的长度预测,提升生成长度的准确性和效率,实验显示其在多个任务中优于现有模型。