D-COT: Disciplined Chain-of-Thought Learning for Efficient Reasoning in Small Language Models
D-COT:为小语言模型高效推理的纪律性推理学习
机构 * Shunsuke Ubukata(独立研究者)
专题命中 推理评测 :CoT(title,abstract);reasoning(title,abstract);chain-of-thought(title,abstract);分类 cs.CL
AI总结 D-CoT通过引入控制标签强制结构化推理,提升小语言模型在推理任务中的性能并减少计算成本。
Comments 9 pages, 3 figures. Code: https://github.com/gitpullpull/DisciplinedChainOfThought | Benchmarks: https://huggingface.co/datasets/gitpullpull/D-CoT-Benchmarks | Dataset: https://huggingface.co/datasets/gitpullpull/D-CoT-datasets