arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 4971 信号源:cs.CL, cs.AI, cs.LG

1. 复杂问题求解 4971 篇

2601.17420 2026-01-27 cs.CV 93%

CoT-Seg: Rethinking Segmentation with Chain-of-Thought Reasoning and Self-Correction

CoT-Seg:重新思考基于链式推理的分割

Shiu-hong Kao, Chak Ho Huang, Huaiqian Liu, Yu-Wing Tai, Chi-Keung Tang

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) Dartmouth College(达特茅斯学院)

专题命中 复杂问题求解 :CoT(title,abstract);reasoning(title,abstract);chain-of-thought(title,abstract);self-correction(title,abstract)

AI总结 CoT-Seg通过结合链式推理和自我纠正,提升复杂分割任务的可靠性与鲁棒性,适用于模糊或错误多发的场景。

Comments Project page: https://danielshkao.github.io/cot-seg.html

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04027 2026-06-10 cs.AI cs.CL 版本更新 93%

Why Does Reasoning Length Converge? Unveiling the Underfitting-Overfitting Trade-off in Chain-of-Thought

CoT-Space: 一种通过强化学习实现内部慢思考的理论框架

Zeyu Gan, Hao Yi, Yong Liu

机构 * Zeyu Gan, Yi Hao, Yong Liu(GAN 赵毅、LIU 刘永)

专题命中 复杂问题求解 :CoT(title_cn,summary_cn);reasoning(title,abstract);chain-of-thought(title,abstract);分类 cs.CL、cs.AI

AI总结 本文提出CoT-Space理论框架,通过强化学习将推理过程从离散的token预测任务转化为连续的推理层面语义空间中的优化过程,揭示了测试时扩展中最优CoT长度的收敛是欠拟合与过拟合基本权衡的自然结果。

Comments Preprint Edition

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23270 2026-07-07 cs.AI 版本更新 93%

CAP-CoT: Cycle Adversarial Prompt for Improving Chain of Thoughts in LLM Reasoning

CAP-CoT:用于提升大语言模型推理中思维链的循环对抗提示

Shuxu Chen, Yitian Zhou, Jiaquan Zhang, Haoyu Bian, Wenrui Hu, Aming Wu, Sungyoung Lee, Chaoning Zhang, Hyundong Shin

机构 * Department of Electronic Engineering, Kyung Hee University(韩国庆熙大学电子工程系) School of Computer Science and Engineering, University of Electronic Science and Technology of China(中国电子科技大学计算机科学与工程学院) Henan Polytechnic University(河南理工大学) School of Computing, Kyung Hee University(韩国庆熙大学计算机学院)

专题命中 复杂问题求解 :CoT(title,title_cn);reasoning(title,abstract);chain-of-thought(abstract);分类 cs.AI

AI总结 CAP-CoT通过循环对抗提示框架提升LLM推理的准确性和稳定性,通过生成候选推理链、构造有缺陷的链并对比反馈,优化推理过程。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02103 2026-05-29 cs.LG cs.CL 93%

How Far Ahead Do LLMs Plan? Uncovering the Latent Horizon in Chain-of-Thought Reasoning

LLMs 能提前多远规划?揭示思维链推理中的潜在视界

Liyan Xu, Mo Yu, Fandong Meng, Jie Zhou

机构 * WeChat AI, Tencent Inc(腾讯AI实验室)

专题命中 复杂问题求解 :CoT(summary_cn,abstract);reasoning(title,abstract);chain-of-thought(title,abstract);planning(abstract)

AI总结 通过探测方法 Tele-Lens 研究 LLMs 在思维链推理中的潜在规划能力,发现其具有短视视界,并基于此提出利用稀疏枢轴位置增强不确定性估计及自动识别 CoT 绕过的假设。

Comments Accepted to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.09621 2025-02-14 cs.CV cs.AI cs.CL 92%

MME-CoT: Benchmarking Chain-of-Thought in Large Multimodal Models for Reasoning Quality, Robustness, and Efficiency

Dongzhi Jiang, Renrui Zhang, Ziyu Guo, Yanwei Li, Yu Qi, Xinyan Chen, Liuhui Wang, Jianhan Jin, Claire Guo, Shen Yan, Bo Zhang, Chaoyou Fu, Peng Gao, Hongsheng Li

专题命中 复杂问题求解 :reasoning(title,abstract);chain-of-thought(title,abstract);CoT(title,abstract);self-correction(abstract)

Comments Project Page: https://mmecot.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08000 2026-06-02 cs.CL cs.LG 92%

SmartThinker: Progressive Chain-of-Thought Length Calibration for Efficient Large Language Model Reasoning

SmartThinker: 渐进式思维链长度校准以实现高效的大语言模型推理

Chenzhi Hu, Qinzhe Hu, Yuhang Xu, Junyi Chen, Ruijie Wang, Shengzhong Liu, Jianxin Li, Fan Wu, Guihai Chen

机构 * Tsinghua University(清华大学)

专题命中 复杂问题求解 :CoT(summary_cn,abstract);reasoning(title,abstract);chain-of-thought(title,abstract);分类 cs.CL、cs.LG

AI总结 针对大型推理模型输出冗余问题,提出基于GRPO的渐进式CoT长度校准方法SmartThinker,通过动态估计最优长度和调节长度奖励系数,在压缩响应长度同时提升准确率。

Comments Accepted by ICML 2026, 18 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15390 2026-04-28 cs.SE cs.AI 92%

Analyzing Chain of Thought (CoT) Approaches in Control Flow Code Deobfuscation Tasks

分析控制流代码去混淆任务中的链式思维(CoT)方法

Seyedreza Mohseni, Sarvesh Baskar, Edward Raff, Manas Gaur

机构 * University of Maryland Baltimore County(马里兰大学巴尔的摩县)

专题命中 复杂问题求解 :CoT(title,title_cn);reasoning(abstract);chain-of-thought(abstract);分类 cs.AI

AI总结 本文探讨了基于链式思维提示的代码去混淆方法,评估了五种先进大语言模型,发现CoT提示显著提高了去混淆质量,GPT5在控制流图重建和语义保留方面表现最佳,平均提升约16%和20.5%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03559 2026-04-21 cs.CL 92%

DiffCoT: Diffusion-styled Chain-of-Thought Reasoning in LLMs

DiffCoT:在大语言模型中采用扩散风格的推理链推理

Shidong Cao, Hongzhan Lin, Yuxuan Gu, Ziyang Luo, Jing Ma

机构 * Hong Kong Baptist University(香港 Baptist 大学) Harbin Institute of Technology(哈尔滨工业大学)

专题命中 复杂问题求解 :chain-of-thought(title,abstract);reasoning(title,abstract);CoT(abstract,abstract_cn);分类 cs.CL

AI总结 DiffCoT通过扩散风格的推理链框架,改进了大语言模型在多步数学问题解决中的鲁棒性和错误纠正能力,通过迭代去噪过程实现中间步骤的统一生成与回顾性修正。

Comments DiffCoT improves multi-step LLM reasoning by applying diffusion-based iterative denoising to correct intermediate Chain-of-Thought steps

Journal ref The 64th Annual Meeting of the Association for Computational Linguistics 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17910 2026-03-23 cs.CL 92%

L2V-CoT: Cross-Modal Transfer of Chain-of-Thought Reasoning via Latent Intervention

L2V-CoT:通过潜在干预实现链式推理的跨模态转移

Yuliang Zhan, Xinyu Tang, Han Wan, Jian Li, Ji-Rong Wen, Hao Sun

专题命中 复杂问题求解 :reasoning(title,abstract);chain-of-thought(title,abstract);CoT(title,abstract);分类 cs.CL

AI总结 本文提出L2V-CoT方法,通过潜在干预将链式推理从LLM转移到VLM,利用低频潜在表示提升多步推理能力,实验表明优于无训练基线和监督方法。

Comments AAAI 2026 oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.17091 2025-04-28 cs.CL 92%

Co-CoT: A Prompt-Based Framework for Collaborative Chain-of-Thought Reasoning

Seunghyun Yoo

专题命中 复杂问题求解 :reasoning(title,abstract);chain-of-thought(title,abstract);CoT(title,abstract);分类 cs.CL

Comments 5 page

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16385 2025-03-21 cs.AI 92%

Deconstructing Long Chain-of-Thought: A Structured Reasoning Optimization Framework for Long CoT Distillation

Yijia Luo, Yulin Song, Xingyao Zhang, Jiaheng Liu, Weixun Wang, GengRu Chen, Wenbo Su, Bo Zheng

专题命中 复杂问题求解 :reasoning(title,abstract);chain-of-thought(title,abstract);CoT(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.07246 2025-01-14 cs.SD cs.CL cs.MM eess.AS 92%

Audio-CoT: Exploring Chain-of-Thought Reasoning in Large Audio Language Model

Ziyang Ma, Zhuo Chen, Yuping Wang, Eng Siong Chng, Xie Chen

专题命中 复杂问题求解 :reasoning(title,abstract);chain-of-thought(title,abstract);CoT(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02778 2026-08-04 cs.CL cs.AI cs.LG 版本更新 91%

Self-Correction Bench: Uncovering and Addressing the Self-Correction Blind Spot in Large Language Models

Self-Correction Bench:揭示并解决大语言模型中的自校正盲点

Ken Tsui

机构 * Independent Researcher(独立研究者)

专题命中 复杂问题求解 :self-correction(title,title_cn);reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 该研究提出Self-Correction Bench框架,发现大语言模型存在64.5%的自校正盲点,经微调或添加“Wait”可显著降低该盲点,揭示了自校正能力未激活的机制。

Comments Accepted to COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00130 2026-07-13 cs.CL 版本更新 91%

Hierarchical Chain-of-Thought: Enhancing LLM Reasoning Performance and Efficiency

层次化思维链提示:提升大语言模型推理性能与效率

Xingshuai Huang, Derek Li, Bahareh Nikpour, Parsa Omidi

机构 * Huawei Technologies Canada, Canada(华为技术加拿大公司,加拿大)

专题命中 复杂问题求解 :reasoning(title,abstract);chain-of-thought(title,abstract);CoT(abstract,abstract_cn);planning(abstract)

AI总结 本文提出层次化思维链提示方法,通过分层步骤规划与执行提升复杂多步推理的准确率和效率,实验显示在多种模型和任务中平均准确率提升6.2%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09567 2025-07-21 cs.AI cs.CL 91%

Towards Reasoning Era: A Survey of Long Chain-of-Thought for Reasoning Large Language Models

Qiguang Chen, Libo Qin, Jinhao Liu, Dengyun Peng, Jiannan Guan, Peng Wang, Mengkang Hu, Yuhang Zhou, Te Gao, Wanxiang Che

机构 * LARG Research Center for Social Computing and Interactive Robotics(社会计算与交互机器人研究中心) Harbin Institute of Technology(哈尔滨工业大学) School of Computer Science and Engineering, Central South University(中南大学计算机科学与工程学院) The University of Hong Kong(香港大学) Fudan University(复旦大学)

专题命中 复杂问题求解 :reasoning(title,abstract);chain-of-thought(title,abstract);CoT(abstract);logical reasoning(abstract)

Comments Paper list and Github tutorial are available at https://github.com/LightChen233/Awesome-Long-Chain-of-Thought-Reasoning. Update 250+ New Reference

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25276 2026-04-29 cs.CV 91%

OmniVTG: A Large-Scale Dataset and Training Paradigm for Open-World Video Temporal Grounding

OmniVTG:一种大规模数据集和开放世界视频时间定位的训练范式

Minghang Zheng, Zihao Yin, Yi Yang, Yuxin Peng, Yang Liu

机构 * Wangxuan Institute of Computer Technology, Peking University(北京大学王轩计算机技术研究所) State Key Laboratory of General Artificial Intelligence, Peking University(北京大学通用人工智能国家重点实验室) Central Media Technology Institute, Huawei Technologies Ltd.(华为技术有限公司中央媒体技术研究所) PKU-WUHAN Institute for Artificial Intelligence, Peking University(北京大学武汉人工智能研究所)

专题命中 复杂问题求解 :chain-of-thought(summary_cn,abstract);self-correction(summary_cn,abstract);CoT(abstract,abstract_cn)

AI总结 本文提出OmniVTG数据集和Self-Correction Chain-of-Thought训练范式,通过语义覆盖迭代扩展管道构建大规模数据集,并利用多模态大语言模型的密集描述能力提升视频时间定位性能。

Comments CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13271 2026-04-16 cs.LG 91%

Enhancing Confidence Estimation in Telco LLMs via Twin-Pass CoT-Ensembling

通过双通道CoT-集成增强电信领域LLM的置信度估计

Anton Saenko, Pranshav Gajjar, Abiodun Ganiyu, Vijay K. Shah

机构 * NextG Wireless Lab(NextG无线实验室) North Carolina State University(北卡罗来纳州立大学)

专题命中 复杂问题求解 :CoT(title,title_cn);reasoning(abstract);分类 cs.LG

AI总结 本文提出双通道CoT-集成方法,通过多独立推理评估提升电信领域LLM的置信度估计,降低ECE误差达88%,提高模型自我评估可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25842 2026-06-01 cs.AI cs.CL 91%

MuCRASP: Multimodal Chain-of-thought Reasoning aware Structured Pruning

MuCRASP: 多模态思维链推理感知的结构化剪枝

Aritra Dutta, Somak Aditya

机构 * Indian Institute of Technology, Kharagpur(印度理工学院,哈里科普尔)

专题命中 复杂问题求解 :reasoning(title,abstract);chain-of-thought(title,abstract);CoT(abstract,abstract_cn);分类 cs.CL、cs.AI

AI总结 针对视觉语言模型在结构化剪枝后思维链推理准确性下降的问题,提出MuCRASP框架,通过识别推理关键令牌并保持跨模态对齐,在压缩下维持推理质量。

Comments Preprint ver. 2

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24269 2025-09-30 cs.AI cs.CL 91%

AdvChain: Adversarial Chain-of-Thought Tuning for Robust Safety Alignment of Large Reasoning Models

Zihao Zhu, Xinyu Wu, Gehan Hu, Siwei Lyu, Ke Xu, Baoyuan Wu

机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) State University of New York at Buffalo(纽约州立大学布法罗分校) Huawei International, Singapore(新加坡华为国际)

专题命中 复杂问题求解 :reasoning(title,abstract);chain-of-thought(title,abstract);CoT(abstract);self-correction(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13606 2026-04-30 cs.CV 90%

ChartVerse: Scaling Chart Reasoning via Reliable Programmatic Synthesis from Scratch

ChartVerse: 通过从零开始可靠程序合成实现图表推理的扩展

Zheng Liu, Honglin Lin, Chonghan Qin, Xiaoyang Wang, Xin Gao, Yu Li, Mengzhang Cai, Yun Zhu, Zhanping Zhong, Qizhi Pei, Zhuoshi Pan, Xiaoran Shang, Bin Cui, Conghui He, Wentao Zhang, Lijun Wu

机构 * Shanghai AI Laboratory(上海人工智能实验室) Peking University(北京大学) Shanghai Jiao Tong University(上海交通大学) Zhongguancun Academy(中关村学院) Beijing Key Laboratory of Software and Hardware Cooperative Artificial Intelligence Systems(北京市软件与硬件协同人工智能系统重点实验室)

专题命中 复杂问题求解 :CoT(summary_cn,abstract);reasoning(title,abstract);chain-of-thought(abstract,abstract_cn)

AI总结 ChartVerse通过从零开始生成复杂图表和可靠推理数据,解决开放源模型开发中高质量训练数据缺乏的问题,采用RPE量化图表复杂度并生成高复杂度图表,结合truth-anchored inverse QA合成和CoT蒸馏提升推理深度。

Comments 29 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22013 2026-07-27 cs.CV cs.AI 新提交 90%

Visual Saliency Steering Distillation for Multimodal Chain-of-Thought Reasoning

用于多模态思维链推理的视觉显著性引导蒸馏

Hao Yang, Jin Wang, Xuejie Zhang

专题命中 复杂问题求解 :reasoning(title,abstract);chain-of-thought(title,abstract);CoT(abstract,abstract_cn);分类 cs.AI

AI总结 研究针对多模态思维链推理在小模型中存在的问题,提出视觉显著性引导蒸馏方法,利用多模态大语言模型注意力图生成扰动图像,经奇异值分解提取引导向量指导层间蒸馏,实验证明该方法能改进推理生成和答案推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10164 2026-04-16 cs.AI 90%

Pruning Long Chain-of-Thought of Large Reasoning Models via Small-Scale Preference Optimization

通过小规模偏好优化修剪大推理模型的长推理链

Bin Hong, Jiayu Liu, Kai Zhang, Jianwen Sun, Mengdi Zhang, Zhenya Huang

机构 * State Key Laboratory of Cognitive Intelligence(认知智能国家重点实验室) University of Science and Technology of China(中国科学技术大学) Institute of Artificial Intelligence(人工智能研究院) Hefei Comprehensive National Science Center(合肥综合性国家科学中心) Central China Normal University(中部师范大学) Meituan(美团) NeoShell

专题命中 复杂问题求解 :reasoning(title,abstract);chain-of-thought(title,abstract);CoT(abstract,abstract_cn);分类 cs.AI

AI总结 本文提出LCPO方法,通过统一的Bradley-Terry损失框架,有效减少大推理模型的输出长度,同时保持推理性能,实验显示在多个基准上平均输出长度减少超过50%。

Comments 26 pages, 8 figures, ICLR'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06923 2025-06-10 cs.AI 90%

Boosting LLM Reasoning via Spontaneous Self-Correction

Xutong Zhao, Tengyu Xu, Xuewei Wang, Zhengxing Chen, Di Jin, Liang Tan, Yen-Ting, Zishun Yu, Zhuokai Zhao, Yun He, Sinong Wang, Han Fang, Sarath Chandar, Chen Zhu

机构 * MetaAI Mila - Quebec AI Institute(魁北克AI研究所)

专题命中 复杂问题求解 :reasoning(title,abstract);self-correction(title,abstract);math reasoning(abstract);verifier(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28008 2026-05-28 cs.AI cs.LG 90%

Zipping the Thought: When and How Compressed Reasoning Data Works in LLM Post-Training

压缩思维:压缩推理数据在LLM后训练中何时以及如何发挥作用

Kohsei Matsutani, Gouki Minegishi, Takeshi Kojima, Yusuke Iwasawa, Yutaka Matsuo

机构 * The University of Tokyo(东京大学)

专题命中 复杂问题求解 :CoT(summary_cn,abstract);reasoning(title,abstract);chain-of-thought(abstract);分类 cs.AI、cs.LG

AI总结 本文通过分类显式、组合和隐式思维链,在合成组合推理任务上实验,发现粗粒度CoT需要更多SFT数据,组合和隐式CoT从数据缩放中获益更多但隐式CoT易导致记忆,后续RLVR会分解压缩步骤,且单向CoT顺序在长序列任务上泛化更强。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20373 2026-02-18 cs.CL cs.AI cs.LG 90%

NPG-Muse: Scaling Long Chain-of-Thought Reasoning with NP-Hard Graph Problems

NPG-Muse: 通过NP难图问题扩展长链推理

Yuyao Wang, Bowen Liu, Jianheng Tang, Nuo Chen, Yuhan Li, Qifan Zhang, Chenyi Zi, Chen Zhang, Jia Li

机构 * HKUST (GZ)(香港科技大学(广州)) Createlink Technology(创联科技)

专题命中 复杂问题求解 :reasoning(title,abstract);chain-of-thought(title,abstract);CoT(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 NPG-Muse通过引入NP难图问题作为合成训练语料库,提升大规模语言模型的长链推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04667 2026-02-13 cs.LG cs.AI cs.CL 90%

Compositional Generalization from Learned Skills via CoT Training: A Theoretical and Structural Analysis for Reasoning

通过Co-T训练从已学技能中实现组合泛化:一种理论和结构分析用于推理

Xinhao Yao, Ruifeng Ren, Yun Liao, Lizhong Ding, Yong Liu

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学人工智能学院) Beijing Key Laboratory of Research on Large Models and Intelligent Governance(北京大型模型与智能治理研究重点实验室) Engineering Research Center of Next-Generation Intelligent Search and Recommendation, MOE(下一代智能搜索与推荐工程研究中心,教育部) Tianjin University of Science and Technology(天津科技大学) Beijing Institute of Technology(北京理工大学)

专题命中 复杂问题求解 :reasoning(title,abstract);CoT(title,abstract);chain-of-thought(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文通过理论和结构分析揭示CoT训练通过组合学习技能提升模型推理泛化能力的核心机制。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09616 2025-12-11 cs.CV cs.AI cs.CL cs.LG 90%

Rethinking Chain-of-Thought Reasoning for Videos

重新思考视频中的链式推理

Yiwu Zhong, Zi-Yuan Hu, Yin Li, Liwei Wang

机构 * The Chinese University of Hong Kong(香港中文大学) University of Wisconsin-Madison(威斯康星大学麦迪逊分校)

专题命中 复杂问题求解 :reasoning(title,abstract);chain-of-thought(title,abstract);CoT(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本研究提出了一种高效的视频推理框架,通过简洁推理和减少的视觉标记提升推理效率和性能,无需依赖传统CoT注释或监督微调。

Comments Technical report

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13260 2025-02-20 cs.CL cs.AI cs.LG 90%

Stepwise Perplexity-Guided Refinement for Efficient Chain-of-Thought Reasoning in Large Language Models

Yingqian Cui, Pengfei He, Jingying Zeng, Hui Liu, Xianfeng Tang, Zhenwei Dai, Yan Han, Chen Luo, Jing Huang, Zhen Li, Suhang Wang, Yue Xing, Jiliang Tang, Qi He

专题命中 复杂问题求解 :reasoning(title,abstract);chain-of-thought(title,abstract);CoT(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.09390 2025-02-14 cs.CL cs.AI cs.LG 90%

SQuARE: Sequential Question Answering Reasoning Engine for Enhanced Chain-of-Thought in Large Language Models

Daniel Fleischer, Moshe Berchansky, Gad Markovits, Moshe Wasserblat

专题命中 复杂问题求解 :reasoning(title,abstract);chain-of-thought(title,abstract);CoT(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.08482 2025-02-13 cs.CL cs.AI cs.LG 90%

Enhancing Auto-regressive Chain-of-Thought through Loop-Aligned Reasoning

Qifan Yu, Zhenyu He, Sijie Li, Xun Zhou, Jun Zhang, Jingjing Xu, Di He

专题命中 复杂问题求解 :reasoning(title,abstract);chain-of-thought(title,abstract);CoT(abstract);分类 cs.CL、cs.AI、cs.LG

Comments work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏