From Reasoning Traces to Reusable Modules: Understanding Compositional Generalization in Language Model Reasoning
从推理轨迹到可复用模块:理解语言模型推理中的组合泛化
Lingjing Kong, Xin Liu, Guangyi Chen, Martin Q. Ma, Xiangchen Song, Yuekai Sun, Mikhail Yurochkin, Taylor W. Killian, Ruslan Salakhutdinov, Kun Zhang, Eric P. Xing, Zhengzhong Liu
机构
*
Carnegie Mellon University(卡内基梅隆大学)
;
Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)
;
Institute of Foundation Models(基础模型研究院)
;
University of Michigan(密歇根大学)
专题命中
指令微调
:SFT(summary_cn,abstract);language model(title,abstract);LLM(abstract_cn);large language model(abstract)
LLM-Based Synthetic Ground Truth Generation for Audio-Based Emotion Classification via In-Context Learning
基于上下文学习的音频情感分类的LLM合成真实标签生成
Qing Huang, Pooja Pol, Jianing Zhang
机构
*
School of Business, Technical University of Applied Sciences Augsburg(应用技术大学阿沙芬堡商学院)
;
Data Science und Autonome Systeme Technologietransferzentrum (TTZ)(数据科学与自主系统技术转移中心(TTZ))
专题命中
指令微调
:LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.LG
Apparent Psychological Profiles of Large Language Models are Largely a Measurement Artifact
大语言模型的心理特征很大程度上是测量假象
Jelena Meyer, David Garcia, Dirk U. Wulff
机构
*
Max Planck Institute for Human Development(马克斯·普朗克人类发展研究所)
;
University of Konstanz(康斯坦茨大学)
;
Barcelona Supercomputing Center(巴塞罗那超级计算中心)
;
University of Basel(巴塞尔大学)
专题命中
指令微调
:large language model(title,abstract);language model(title,abstract);LLM(summary_cn,abstract_cn);分类 cs.CL、cs.AI
Learning When to Reason for Text-to-SQL via SFT and DPO
通过监督微调(SFT)和直接偏好优化(DPO)学习何时对文本到SQL进行推理
Soohyuk Jang, Jiheum Yeom, Nohil Park, Sang Hun Kim, Yoonyoung Choi, Kiwook Bae, Sungroh Yoon
机构
*
Department of Electrical and Computer Engineering, Seoul National University(首尔国立大学电气与计算机工程系)
;
AI Center, Samsung Electronics(三星电子人工智能中心)
;
AIIS, ASRI, INMC, ISRC, and IPAI, Seoul National University(首尔国立大学人工智能研究所、高级科学研究所以及综合纳米技术中心、信息存储研究中心和人工智能平台研究所)