arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 44719 信号源:cs.CL, cs.AI, cs.LG

1. 数学推理 3208 篇

2510.19842 2026-03-03 cs.AI cs.LG 86%

DAG-Math: Graph-of-Thought Guided Mathematical Reasoning in LLMs

DAG-Math: 图思维引导的大型语言模型数学推理

Yuanhe Zhang, Ilja Kuzborskij, Jason D. Lee, Chenlei Leng, Fanghui Liu

机构 * Department of Statistics, University of Warwick(沃里克大学统计系) Google DeepMind(谷歌DeepMind) Department of Applied Mathematics, Hong Kong Polytechnic University(香港理工大学应用数学系) School of Mathematical Sciences, Institute of Natural Sciences and MOE-LSC, Shanghai Jiao Tong University(上海交通大学数学科学学院)

专题命中 数学推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.AI、cs.LG

AI总结 DAG-Math通过构建图思维引导的数学推理框架,评估LLM的推理能力,揭示了推理忠实度与最终答案准确性的差异。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14444 2026-02-17 cs.LG cs.AI 86%

Broken Chains: The Cost of Incomplete Reasoning in LLMs

断裂的链条:在大语言模型中不完整推理的成本

Ian Su, Gaurav Purushothaman, Jey Narayan, Ruhika Goel, Kevin Zhu, Sunishchal Dev, Yash More, Maheep Chaudhary

专题命中 数学推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.AI、cs.LG

AI总结 研究探讨了大语言模型在不同推理模式下在标记限制下的表现,发现截断推理可能有害,代码退化较好,混合推理表现欠佳,鲁棒性取决于模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12022 2026-02-13 cs.CL cs.AI 86%

Teaching LLMs According to Their Aptitude: Adaptive Reasoning for Mathematical Problem Solving

根据能力教学LLMs:数学问题解决的自适应推理

Xin Xu, Yan Xu, Tianhao Chen, Yuchen Yan, Chengwu Liu, Zaoyu Chen, Yufei Wang, Yichun Yin, Yasheng Wang, Lifeng Shang, Qun Liu, Lu Yin

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) Huawei Noah’s Ark Lab(华为诺亚实验室) Zhejiang University(浙江大学) Peking University(北京大学) The Hong Kong Polytechnic University(香港理工大学) University of Surrey(萨里大学)

专题命中 数学推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI

AI总结 TATA通过自适应框架使LLMs根据自身能力自主调整推理策略,提升数学问题解决的效率和准确性。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21124 2026-02-12 cs.AI cs.CL 86%

Expanding Reasoning Potential in Foundation Model by Learning Diverse Chains of Thought Patterns

通过学习多样的思维链模式扩展基础模型的推理潜力

Xuemiao Zhang, Can Ren, Chengying Tu, Rongxiang Weng, Shuo Wang, Hongfei Yan, Jingang Wang, Xunliang Cai

机构 * School of Computer Science, Peking University(北京大学计算机科学系) Meituan(美团) State Key Laboratory of Multimedia Information Processing, Peking University(北京大学多媒体信息处理国家重点实验室)

专题命中 数学推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI

AI总结 本文提出通过学习富含高价值推理模式的多样化数据,扩展基础模型的推理潜力,显著提升模型在数学推理任务上的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08332 2026-02-10 cs.CL cs.AI 86%

Latent Reasoning with Supervised Thinking States

基于监督思考状态的潜在推理

Ido Amos, Avi Caciularu, Mor Geva, Amir Globerson, Jonathan Herzig, Lior Shani, Idan Szpektor

机构 * Google Research(谷歌研究)

专题命中 数学推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI

AI总结 本文提出Thinking States方法,通过在输入处理过程中生成思考token,实现更高效的潜在推理,实验表明其在多个推理任务中表现优异,且在延迟和长序列外推方面优于CoT。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01017 2026-02-03 cs.LG cs.AI 86%

How Does Unfaithful Reasoning Emerge from Autoregressive Training? A Study of Synthetic Experiments

自回归训练如何导致不忠推理?合成实验研究

Fuxin Wang, Amr Alazali, Yiqiao Zhong

机构 * University of Wisconsin-Madison(威斯康星大学麦迪逊分校)

专题命中 数学推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.AI、cs.LG

AI总结 本研究通过合成实验探讨自回归训练如何导致不忠推理,发现训练噪声阈值影响推理的忠实性,模型在低噪声下能学习因果推理,高噪声下则出现跳步推理。

Comments 25 pages, 23 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21711 2026-01-30 cs.CL cs.AI 86%

TACLer: Tailored Curriculum Reinforcement Learning for Efficient Reasoning

TACLer: 针对高效推理的定制课程强化学习

Huiyuan Lai, Malvina Nissim

机构 * Department of XXX, University of YYY, Location, Country(XXX系,YYY大学,地点,国家) School of ZZZ, Institute of WWW, Location, Country(ZZZ学院,WWW研究所,地点,国家) Center for Language and Cognition (CLCG), University of Groningen, The Netherlands(语言与认知中心(CLCG),格罗宁根大学,荷兰)

专题命中 数学推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI

AI总结 TACLer通过定制课程强化学习提升推理效率,减少计算成本并提高准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.21961 2026-01-28 cs.CL cs.AI 86%

Entropy-Gated Branching for Efficient Test-Time Reasoning

熵门分支用于高效的测试时间推理

Xianzhi Li, Ethan Callanan, Abdellah Ghassel, Xiaodan Zhu

机构 * Department of Electrical and Computer Engineering & Ingenuity Labs Research Institute(电气与计算机工程系及创新实验室研究所)

专题命中 数学推理 :reasoning(title,abstract);test-time compute(abstract);verifier(abstract);分类 cs.CL、cs.AI

AI总结 熵门分支通过在高不确定步骤进行分支并修剪扩展,提升LLM测试时间推理的准确性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22255 2026-01-26 cs.AI cs.LG 86%

Shape of Thought: When Distribution Matters More than Correctness in Reasoning Tasks

思维的形状:当分布比正确性更重要时在推理任务中的表现

Abhranil Chandra, Ayush Agrawal, Arian Hosseini, Sebastian Fischmeister, Rishabh Agarwal, Navin Goyal, Aaron Courville

机构 * University of Waterloo(滑铁卢大学) University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校) MILA - Quebec AI Institute(魁北克人工智能研究所) Université de Montréal(蒙特利尔大学) Microsoft Research India(微软印度研究院) Google DeepMind(谷歌DeepMind) Periodic Labs(周期实验室)

专题命中 数学推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.AI、cs.LG

AI总结 通过训练合成数据集中的链式思考轨迹,即使最终答案错误,也能提升语言模型的推理能力,表明分布比正确性更重要。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11574 2026-01-21 cs.LG cs.AI 86%

Quantization Meets Reasoning: Exploring and Mitigating Degradation of Low-Bit LLMs in Mathematical Reasoning

量化与推理:探索和缓解低比特LLM在数学推理中的退化

Zhen Li, Yupeng Su, Songmiao Wang, Runming Yang, Congkai Xie, Aofan Liu, Ming Li, Jiannong Cao, Yuan Xie, Ngai Wong, Hongxia Yang

机构 * The Hong Kong Polytechnic University(香港理工大学) University of California, Santa Barbara(加州大学圣芭芭拉分校) Peking University(北京大学) The Hong Kong University of Science and Technology(香港科学与技术大学) The University of Hong Kong(香港大学)

专题命中 数学推理 :reasoning(title,abstract);chain-of-thought(abstract);math reasoning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出了一种轻量级方法,通过定位和恢复量化模型中最早出现的故障步骤,有效缓解低比特LLM在数学推理中的退化问题。

Comments 27pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17079 2025-12-22 cs.LG cs.AI 86%

Can Large Reasoning Models Improve Accuracy on Mathematical Tasks Using Flawed Thinking?

大推理模型能否通过错误推理提升数学任务的准确性?

Saraswathy Amjith, Mihika Dusad, Neha Muramalla, Shweta Shah

机构 * MIT(麻省理工学院)

专题命中 数学推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.AI、cs.LG

AI总结 本研究通过训练模型处理故意错误推理轨迹,提升其在数学任务中的错误恢复能力,同时保持准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22570 2025-12-01 cs.AI cs.CL 86%

DeepSeekMath-V2: Towards Self-Verifiable Mathematical Reasoning

DeepSeekMath-V2:迈向自我验证的数学推理

Zhihong Shao, Yuxiang Luo, Chengda Lu, Z. Z. Ren, Jiewen Hu, Tian Ye, Zhibin Gou, Shirong Ma, Xiaokang Zhang

机构 * DeepSeek-AI

专题命中 数学推理 :reasoning(title,abstract);test-time compute(abstract);verifier(abstract);分类 cs.CL、cs.AI

AI总结 DeepSeekMath-V2通过自我验证机制提升数学推理能力,实现定理证明的高准确率和严谨性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.00971 2025-10-28 cs.LG cs.AI 86%

Reasoning as an Adaptive Defense for Safety

Taeyoun Kim, Fahim Tajwar, Aditi Raghunathan, Aviral Kumar

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 数学推理 :reasoning(title,abstract);chain-of-thought(abstract);test-time compute(abstract);分类 cs.AI、cs.LG

Comments 44 pages, 10 Figures, 7 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10252 2025-10-21 cs.CL cs.AI 86%

Audit-of-Understanding: Posterior-Constrained Inference for Mathematical Reasoning in Language Models

Samir Abdaljalil, Erchin Serpedin, Khalid Qaraqe, Hasan Kurban

机构 * Texas A&M University(德克萨斯大学) Hamad Bin Khalifa University(哈马德·本·哈利法大学)

专题命中 数学推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23867 2025-10-09 cs.CL cs.AI 86%

InfiMed: Low-Resource Medical MLLMs with Advancing Understanding and Reasoning

Zeyu Liu, Zhitian Hou, Guanghao Zhu, Zhijie Sang, Congkai Xie, Hongxia Yang

机构 * The Hong Kong Polytechnic University(香港理工大学) Sun Yat-sen University(中山大学)

专题命中 数学推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22048 2025-10-01 cs.CL cs.LG 86%

ThinkEdit: Interpretable Weight Editing to Mitigate Overly Short Thinking in Reasoning Models

Chung-En Sun, Ge Yan, Tsui-Wei Weng

机构 * UCSD CSE(加州大学圣地亚哥分校计算机科学系) UCSD HDSI(加州大学圣地亚哥分校人类发展与应用科学学院)

专题命中 数学推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.LG

Comments Accepted to EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.19817 2025-09-23 cs.AI cs.CL cs.HC 86%

Step Guided Reasoning: Improving Mathematical Reasoning using Guidance Generation and Step Reasoning

Lang Cao, Yingtian Zou, Chao Peng, Renhong Chen, Wu Ning, Yitong Li

机构 * Huawei Technologies Co., Ltd.(华为技术有限公司) Shanghai Jiaotong University(上海交通大学)

专题命中 数学推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI

Comments 9 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16110 2025-07-23 cs.AI cs.LG 86%

Expert-Guided LLM Reasoning for Battery Discovery: From AI-Driven Hypothesis to Synthesis and Characterization

Shengchao Liu, Hannan Xu, Yan Ai, Huanxin Li, Yoshua Bengio, Harry Guo

机构 * Université de Montréal(蒙特利尔大学) University of Oxford(牛津大学) University College London(伦敦大学学院) Mila - Québec AI Institute(魁北克人工智能研究所) CIFAR AI Chair(CIFAR人工智能 chair) University of Ottawa(渥太华大学) National Research Council Canada(加拿大国家研究理事会)

专题命中 数学推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23091 2025-06-24 cs.AI cs.CL 86%

Infi-MMR: Curriculum-based Unlocking Multimodal Reasoning via Phased Reinforcement Learning in Multimodal Small Language Models

Zeyu Liu, Yuhang Liu, Guanghao Zhu, Congkai Xie, Zhen Li, Jianbo Yuan, Xinyao Wang, Qing Li, Shing-Chi Cheung, Shengyu Zhang, Fei Wu, Hongxia Yang

机构 * The Hong Kong Polytechnic University(香港理工大学) Zhejiang University(浙江大学) University of Electronic Science and Technology of China(电子科技大学) Reallm Labs(Reallm 实验室) Amazon(亚马逊) The Hong Kong University of Science and Technology(香港理工大学)

专题命中 数学推理 :reasoning(title,abstract);math reasoning(abstract);logical reasoning(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.11651 2025-06-16 cs.LG cs.CL 86%

T1: Advancing Language Model Reasoning through Reinforcement Learning and Inference Scaling

Zhenyu Hou, Xin Lv, Rui Lu, Jiajie Zhang, Yujiang Li, Zijun Yao, Juanzi Li, Jie Tang, Yuxiao Dong

机构 * Tsinghua University(清华大学)

专题命中 数学推理 :reasoning(title,abstract);chain-of-thought(abstract);math reasoning(abstract);分类 cs.CL、cs.LG

Comments Accepted to ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08446 2025-06-11 cs.AI cs.CL 86%

A Survey on Large Language Models for Mathematical Reasoning

Peng-Yuan Wang, Tian-Shuo Liu, Chenyang Wang, Yi-Di Wang, Shu Yan, Cheng-Xing Jia, Xu-Hui Liu, Xin-Wei Chen, Jia-Cheng Xu, Ziniu Li, Yang Yu

机构 * National Key Laboratory for Novel Software Technology(国家新型软件技术重点实验室) School of Artificial Intelligence(人工智能学院) Nanyang Technological University(南洋理工大学) Skywork AI Singapore(Skywork AI新加坡) The Chinese University of Hong Kong Shenzhen(香港中文大学(深圳))

专题命中 数学推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03723 2025-06-05 cs.CL cs.AI 86%

Verbalized Confidence Triggers Self-Verification: Emergent Behavior Without Explicit Reasoning Supervision

Chaeyun Jang, Moonseok Choi, Yegon Kim, Hyungi Lee, Juho Lee

专题命中 数学推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.05673 2025-05-28 cs.AI cs.CL 86%

Flow of Reasoning: Training LLMs for Divergent Reasoning with Minimal Examples

Fangxu Yu, Lai Jiang, Haoqiang Kang, Shibo Hao, Lianhui Qin

专题命中 数学推理 :reasoning(title,abstract);math reasoning(abstract);logical reasoning(abstract);分类 cs.CL、cs.AI

Comments Accepted to ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18086 2025-05-26 cs.AI cs.LG 86%

Stable Reinforcement Learning for Efficient Reasoning

Muzhi Dai, Shixuan Liu, Qingyi Si

专题命中 数学推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15778 2025-05-22 cs.CL cs.AI 86%

Soft Thinking: Unlocking the Reasoning Potential of LLMs in Continuous Concept Space

Zhen Zhang, Xuehai He, Weixiang Yan, Ao Shen, Chenyang Zhao, Shuohang Wang, Yelong Shen, Xin Eric Wang

机构 * University of California, Santa Barbara(加州大学圣芭芭拉分校) University of California, Santa Cruz(加州大学圣克ruz分校) University of California, Los Angeles(加州大学洛杉矶分校) Purdue University(普渡大学) LMSYS Org(LMSYS组织) Microsoft(微软)

专题命中 数学推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14178 2025-05-21 cs.CL cs.AI 86%

Tokenization Constraints in LLMs: A Study of Symbolic and Arithmetic Reasoning Limits

Xiang Zhang, Juntai Cao, Jiaqi Wei, Yiwei Xu, Chenyu You

专题命中 数学推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.07686 2025-05-20 cs.AI cs.LG 86%

S-GRPO: Early Exit via Reinforcement Learning in Reasoning Models

Muzhi Dai, Chenxu Yang, Qingyi Si

机构 * Huawei Technologies Co., Ltd.(华为技术有限公司) Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所)

专题命中 数学推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.05419 2025-04-09 cs.AI cs.CL 86%

Reasoning Models Know When They're Right: Probing Hidden States for Self-Verification

Anqi Zhang, Yulin Chen, Jane Pan, Chen Zhao, Aurojit Panda, Jinyang Li, He He

专题命中 数学推理 :reasoning(title,abstract);logical reasoning(abstract);verifier(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.01857 2025-04-03 cs.CL cs.AI 86%

Cross-Lingual Consistency: A Novel Inference Framework for Advancing Reasoning in Large Language Models

Zhiwei Yu, Tuo Li, Changhong Wang, Hui Chen, Lang Zhou

专题命中 数学推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.02344 2025-03-21 cs.LG cs.CL 86%

Seq-VCR: Preventing Collapse in Intermediate Transformer Representations for Enhanced Reasoning

Md Rifat Arefin, Gopeshh Subbaraj, Nicolas Gontier, Yann LeCun, Irina Rish, Ravid Shwartz-Ziv, Christopher Pal

专题命中 数学推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏