Can Post-Training Transform LLMs into Causal Reasoners?
训练后能否将大语言模型转变为因果推理者?
机构 * Shanghai Artificial Intelligence Library(上海人工智能图书馆) ; Fudan University(复旦大学) ; Tongji University(同济大学)
专题命中 后训练与偏好优化 :LLM(summary_cn,abstract);post-training(title,abstract);SFT(abstract,abstract_cn);large language model(abstract)
AI总结 本文通过CauGym数据集评估了训练后方法对LLM因果推理能力的提升,发现适当训练可使小型模型在因果推理任务中超越大模型。