arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 44666 信号源:cs.CL, cs.AI, cs.LG

1. 数学推理 3205 篇

2510.09592 2026-05-12 cs.CL 87%

Mind-Paced Speaking: A Dual-Brain Approach to Real-Time Reasoning in Spoken Language Models

有意识说话:一种双脑方法用于语音语言模型中的实时推理

Donghang Wu, Haoyang Zhang, Jun Chen, Xiangyu, Zhang, Hexin Liu, Eng Siong Chng, Fei Tian, Xuerui Yang, Xiangyu Zhang, Daxin Jiang, Gang Yu

机构 * StepFun Nanyang Technological University(南洋理工大学) University of New South Wales(新南威尔士大学)

专题命中 数学推理 :reasoning(title,abstract);CoT(abstract,abstract_cn);chain-of-thought(abstract);分类 cs.CL

AI总结 本文提出Mind-Paced Speaking方法,通过双脑架构实现语音语言模型的实时推理,显著提升推理性能并降低延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04415 2026-05-12 cs.CL cs.CV 87%

Dual Tuning for Reasoning Efficacy-Driven Data Curation in Multimodal LLM Training

双调优:面向多模态大语言模型训练的推理效能驱动的数据筛选

Ruobing Zheng, Tianqi Li, Jianing Li, Qingpei Guo, Yi Yuan, Jingdong Chen

机构 * Ant Group(蚂蚁集团)

专题命中 数学推理 :reasoning(title,abstract);CoT(abstract,abstract_cn);chain-of-thought(abstract);分类 cs.CL

AI总结 本文提出双调优框架,通过评估训练数据对推理训练的收益及推理训练的效能,指导多模态大语言模型的数据筛选与训练策略匹配。

Comments Project Page: https://digital-avatar.github.io/ai/ThinkingBoundary/

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20956 2026-04-30 cs.CR cs.CL 87%

Self-Jailbreaking: Language Models Can Reason Themselves Out of Safety Alignment After Benign Reasoning Training

自我越狱:语言模型在良性推理训练后可通过推理自行摆脱安全对齐

Zheng-Xin Yong, Stephen H. Bach

机构 * Brown University(布朗大学)

专题命中 数学推理 :reasoning(title,abstract);CoT(abstract,abstract_cn);分类 cs.CL

AI总结 研究发现推理语言模型在良性训练后可能通过引入良性假设来规避安全限制,提出通过增加安全推理数据训练可缓解该问题。

Comments Published in The Fourteenth International Conference on Learning Representations (ICLR) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00546 2026-04-21 cs.CL 87%

ThinkBrake: Efficient Reasoning via Log-Probability Margin Guided Decoding

ThinkBrake: 通过对数概率边际引导解码实现高效推理

Sangjun Song, Minjae Oh, Seungkyu Lee, Sungmin Jo, Yohan Jo

机构 * Graduate School of Data Science, Seoul National University(数据科学研究生院,首尔国立大学)

专题命中 数学推理 :reasoning(title,abstract);CoT(abstract,abstract_cn);chain-of-thought(abstract);分类 cs.CL

AI总结 ThinkBrake通过监控句子边界处最高延续词与终止词的对数概率边际,减少过度推理,提升推理效率和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17297 2026-04-21 cs.CL 87%

CRISP: Compressing Redundancy in Chain-of-Thought via Intrinsic Saliency Pruning

通过内在显著性剪枝压缩链式推理中的冗余

Yangsong Lan, Hongliang Dai, Piji Li

机构 * College of Artificial Intelligence, Nanjing University of Aeronautics and Astronautics(南京航空航天大学人工智能学院) The Key Laboratory of Brain-Machine Intelligence Technology, Ministry of Education(教育部脑机智能技术重点实验室)

专题命中 数学推理 :chain-of-thought(title,abstract);CoT(abstract,abstract_cn);reasoning(abstract);分类 cs.CL

AI总结 本文提出CRISP框架,通过利用模型内在显著性信号压缩链式推理,减少冗余并保持逻辑一致性,实验表明在不牺牲准确性的情况下实现50-60%的token减少。

Comments Findings of the Association for Computational Linguistics: ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15701 2026-04-20 cs.CL 87%

Improving Reasoning Capabilities in Small Models through Mixture-of-Layers Distillation with Stepwise Attention on Key Information

通过关键信息的分步注意力混合层蒸馏提升小模型的推理能力

Yao Chen, Jiawei Sheng, Wenyuan Zhang, Tingwen Liu

机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络安全学院)

专题命中 数学推理 :reasoning(title,abstract);CoT(abstract,abstract_cn);chain-of-thought(abstract);分类 cs.CL

AI总结 本文提出一种基于分步注意力的混合层蒸馏方法,通过引导学生模型逐步聚焦关键信息,提升小模型的推理能力,并在多个数学和常识推理数据集上取得一致性能提升。

Comments Accepted at EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02996 2026-04-20 cs.CL 87%

Large Reasoning Models Are (Not Yet) Multilingual Latent Reasoners

大型推理模型是(尚未)多语言潜在推理器

Yihong Liu, Raoyuan Zhao, Hinrich Schütze, Michael A. Hedderich

机构 * cisnlp

专题命中 数学推理 :reasoning(title,abstract);CoT(abstract,abstract_cn);chain-of-thought(abstract);分类 cs.CL

AI总结 本文研究了多语言潜在推理在大型推理模型中的表现,发现其在资源丰富语言中表现较强,但在低资源语言中较弱,且在更难的基准测试中更不明显。

Comments ACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14768 2026-04-17 cs.AI 87%

CoTEvol: Self-Evolving Chain-of-Thoughts for Data Synthesis in Mathematical Reasoning

CoTEvol:用于数学推理数据合成的自演化思维链

Zhuo Wang, Zhuo Zhang, Yafu Li, Yu Cheng, Lizhen Qu, Zenglin Xu

机构 * Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院) The Chinese University of Hong Kong(香港中文大学) Monash University(墨尔本大学) Independent Researcher(独立研究者) Shanghai Academy of AI for Science(上海人工智能科学研究院)

专题命中 数学推理 :reasoning(title,abstract);CoT(abstract,abstract_cn);chain-of-thought(abstract);分类 cs.AI

AI总结 本文提出CoTEvol,一种基于遗传算法的思维链生成框架,通过全局交叉和局部突变提升生成准确性和多样性,实验表明其在数学推理任务中效果优于传统方法。

Comments acl2026 findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.15375 2026-02-10 cs.CL eess.AS 87%

STITCH: Simultaneous Thinking and Talking with Chunked Reasoning for Spoken Language Models

STITCH:基于分块推理的 spoken language models 的同时思考与说话

Cheng-Han Chiang, Xiaofei Wang, Linjie Li, Chung-Ching Lin, Kevin Lin, Shujie Liu, Zhendong Wang, Zhengyuan Yang, Hung-yi Lee, Lijuan Wang

机构 * National Taiwan University(国立台湾大学) Microsoft(微软)

专题命中 数学推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);math reasoning(abstract)

AI总结 STITCH通过分块推理实现语音语言模型的同时思考与说话,提升推理效率与响应速度。

Comments ICLR 2026 camera-ready version. Project page: https://d223302.github.io/STITCH/

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05616 2026-01-12 cs.LG 87%

Dual-Phase LLM Reasoning: Self-Evolved Mathematical Frameworks

双阶段LLM推理:自演化数学框架

ShaoZhen Liu, Xinting Huang, Houwen Peng, Xin Chen, Xinyang Song, Qi Li, Zhenan Sun

专题命中 数学推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);self-correction(abstract)

AI总结 本文提出双阶段训练框架,通过自动生成的长链式思考数据增强模型自我纠正能力,提升数学问题解决性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19640 2026-01-08 cs.CL 87%

Interleaved Reasoning for Large Language Models via Reinforcement Learning

通过强化学习实现大型语言模型的交错推理

Roy Xie, David Qiu, Deepak Gopinath, Dong Lin, Yanchao Sun, Chong Wang, Saloni Potdar, Bhuwan Dhingra

机构 * Apple(苹果公司) Duke University(杜克大学)

专题命中 数学推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);logical reasoning(abstract)

AI总结 通过强化学习实现大型语言模型的交错推理,提升推理效率和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19131 2025-11-25 cs.CL 87%

Eliciting Chain-of-Thought in Base LLMs via Gradient-Based Representation Optimization

通过基于梯度的表示优化在基础LLM中引导链式思维

Zijian Wang, Yanxiang Ma, Chang Xu

机构 * Zijian Wang, Yanxiang Ma, Chang Xu(作者)

专题命中 数学推理 :chain-of-thought(title,abstract);reasoning(abstract);CoT(abstract);logical reasoning(abstract)

AI总结 本文提出了一种基于概率条件生成的隐藏状态优化方法,通过梯度优化提升基础LLM的链式思维推理能力,有效解决隐藏状态操纵中的分布偏移问题。

Comments AAAI2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26041 2025-10-15 cs.CL 87%

Unspoken Hints: Accuracy Without Acknowledgement in LLM Reasoning

Arash Marioriyad, Shaygan Adim, Nima Alighardashi, Mahdieh Soleymani Banghshah, Mohammad Hossein Rohban

专题命中 数学推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);logical reasoning(abstract)

Comments 5 Pages, 4 Figures, 4 Tables

Journal ref 39th Conference on Neural Information Processing Systems, 2025, Workshop: Reliable ML from Unreliable Data

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02536 2025-09-30 cs.CL 87%

Answer Convergence as a Signal for Early Stopping in Reasoning

Xin Liu, Lu Wang

机构 * Computer Science and Engineering University of Michigan(计算机科学与工程系密歇根大学)

专题命中 数学推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);math reasoning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10822 2025-06-13 cs.CL 87%

ReCUT: Balancing Reasoning Length and Accuracy in LLMs via Stepwise Trails and Preference Optimization

Zhensheng Jin, Xinze Li, Yifan Ji, Chunyi Peng, Zhenghao Liu, Qi Shi, Yukun Yan, Shuo Wang, Furong Peng, Ge Yu

机构 * School of Computer Science and Engineering, Northeastern University, China(东北大学计算机科学与工程学院) Department of Computer Science and Technology, Institute for AI, Tsinghua University, China(清华大学计算机科学与技术系) Beijing National Research Center for Information Science and Technology, China(北京信息科学与技术国家研究中心) Institute of Big Data Science and Industry/School of Computer and Information Technology, Shanxi University, China(山西大学大数据科学与产业研究院/计算机与信息学院)

专题命中 数学推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);math reasoning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.21233 2025-05-01 cs.CL 87%

Phi-4-Mini-Reasoning: Exploring the Limits of Small Reasoning Language Models in Math

Haoran Xu, Baolin Peng, Hany Awadalla, Dongdong Chen, Yen-Chun Chen, Mei Gao, Young Jin Kim, Yunsheng Li, Liliang Ren, Yelong Shen, Shuohang Wang, Weijian Xu, Jianfeng Gao, Weizhu Chen

机构 * Microsoft(微软)

专题命中 数学推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);math reasoning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.11919 2025-04-17 cs.AI 87%

Rethinking the Generation of High-Quality CoT Data from the Perspective of LLM-Adaptive Question Difficulty Grading

Qianjin Yu, Keyu Wu, Zihan Chen, Chushu Zhang, Manlin Mei, Lingjun Huang, Fang Tan, Yongsheng Du, Kunlin Liu, Yurui Zhu

专题命中 数学推理 :CoT(title,abstract);reasoning(abstract);chain-of-thought(abstract);math reasoning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.02301 2024-07-11 cs.CL 87%

mCoT: Multilingual Instruction Tuning for Reasoning Consistency in Language Models

Huiyuan Lai, Malvina Nissim

专题命中 数学推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);math reasoning(abstract)

Comments Accepted to ACL 2024 main (Corrected Figure 2 (a))

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.06332 2024-05-27 cs.CL 87%

InternLM-Math: Open Math Large Language Models Toward Verifiable Reasoning

Huaiyuan Ying, Shuo Zhang, Linyang Li, Zhejian Zhou, Yunfan Shao, Zhaoye Fei, Yichuan Ma, Jiawei Hong, Kuikun Liu, Ziyi Wang, Yudong Wang, Zijian Wu, Shuaibin Li, Fengzhe Zhou, Hongwei Liu, Songyang Zhang, Wenwei Zhang, Hang Yan, Xipeng Qiu, Jiayu Wang, Kai Chen, Dahua Lin

专题命中 数学推理 :reasoning(title,abstract);chain-of-thought(abstract);math reasoning(abstract);verifier(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.01707 2023-06-08 cs.CL 87%

Learning Multi-Step Reasoning by Solving Arithmetic Tasks

Tianduo Wang, Wei Lu

专题命中 数学推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);math reasoning(abstract)

Comments ACL 2023. Code and data are available at https://github.com/TianduoWang/MsAT

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05802 2026-08-07 cs.CL cs.LG 新提交 87%

On-Policy Delta Distillation for Multilingual Math Reasoning

面向多语言数学推理的在线策略增量蒸馏

Byeongho Heo, Jaehui Hwang, Sangdoo Yun, Dongyoon Han

机构 * NAVER AI Lab(NAVER AI实验室)

专题命中 数学推理 :reasoning(title,abstract);math reasoning(title);分类 cs.CL、cs.LG

AI总结 本研究针对多语言数学推理任务,提出OPD²方法,实验表明其在韩语、日语上性能提升显著,且能缩小英语与韩语的性能差距,凸显多语言数据的重要性。

Comments 9 pages, 3 figures, 10 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19563 2026-04-20 cs.AI cs.CL 87%

TabularMath: Understanding Math Reasoning over Tables with Large Language Models

TabularMath: 通过大规模语言模型理解表格上的数学推理

Shi-Yu Tian, Zhi Zhou, Wei Dong, Kun-Yang Yu, Ming Yang, Zi-Jian Cheng, Lan-Zhe Guo, Yu-Feng Li

机构 * National Key Laboratory for Novel Software Technology, Nanjing University(南京大学新型软件技术国家重点实验室) School of Artificial Intelligence, Nanjing University(南京大学人工智能学院) School of Intelligence Science and Technology, Nanjing University(南京大学智能科学与技术学院)

专题命中 数学推理 :reasoning(title,abstract);math reasoning(title);分类 cs.CL、cs.AI

AI总结 本文提出TabularMath基准,通过神经符号框架将数学问题转化为可扩展的表格推理任务,揭示表格复杂度、质量及表征对推理性能的影响,发现低质量表格对当前LLM的可靠性构成严重风险。

Comments Accepted by ACL 26

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01528 2025-10-03 cs.AI cs.LG 87%

Towards Interpretable and Inference-Optimal COT Reasoning with Sparse Autoencoder-Guided Generation

Daniel Zhao, Abhilash Shankarampeta, Lanxiang Hu, Tajana Rosing, Hao Zhang

机构 * University of California, San Diego(加州大学圣地亚哥分校)

专题命中 数学推理 :reasoning(title,abstract);CoT(title);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.20533 2025-02-26 cs.LG cs.CL 87%

Guiding Through Complexity: What Makes Good Supervision for Hard Math Reasoning Tasks?

Xuan He, Da Yin, Nanyun Peng

专题命中 数学推理 :reasoning(title,abstract);math reasoning(title);分类 cs.CL、cs.LG

Comments NAACL 2025 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.10839 2024-12-20 cs.CL cs.LG 87%

Benchmarking Large Language Models for Math Reasoning Tasks

Kathrin Seßler, Yao Rong, Emek Gözlüklü, Enkelejda Kasneci

专题命中 数学推理 :reasoning(title,abstract);math reasoning(title);分类 cs.CL、cs.LG

Comments This work has been submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.08196 2024-10-11 cs.CL cs.AI cs.CV 87%

MathCoder2: Better Math Reasoning from Continued Pretraining on Model-translated Mathematical Code

Zimu Lu, Aojun Zhou, Ke Wang, Houxing Ren, Weikang Shi, Junting Pan, Mingjie Zhan, Hongsheng Li

专题命中 数学推理 :reasoning(title,abstract);math reasoning(title);分类 cs.CL、cs.AI

Comments https://github.com/mathllm/MathCoder2

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.02864 2024-06-06 cs.CL cs.AI 87%

NUMCoT: Numerals and Units of Measurement in Chain-of-Thought Reasoning using Large Language Models

Ancheng Xu, Minghuan Tan, Lei Wang, Min Yang, Ruifeng Xu

专题命中 数学推理 :reasoning(title,abstract);chain-of-thought(title);分类 cs.CL、cs.AI

Comments Findings of ACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.02746 2022-12-07 cs.AI cs.LG 87%

UniGeo: Unifying Geometry Logical Reasoning via Reformulating Mathematical Expression

Jiaqi Chen, Tong Li, Jinghui Qin, Pan Lu, Liang Lin, Chongyu Chen, Xiaodan Liang

专题命中 数学推理 :reasoning(title,abstract);logical reasoning(title);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07843 2026-07-03 cs.LG cs.AI cs.CL 版本更新 87%

ThreadWeaver: Adaptive Threading for Efficient Parallel Reasoning in Language Models

ThreadWeaver:自适应线程化实现语言模型高效并行推理

Long Lian, Sida Wang, Felix Juefei-Xu, Tsu-Jui Fu, Xiuyu Li, Adam Yala, Trevor Darrell, Alane Suhr, Yuandong Tian, Xi Victoria Lin

机构 * UC Berkeley(伯克利大学) UCSF(旧金山大学)

专题命中 数学推理 :reasoning(title,abstract);chain-of-thought(abstract);math reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 提出ThreadWeaver框架,通过两阶段并行轨迹生成、基于trie的展开设计和并行化感知强化学习,在保持与顺序推理模型相当准确率的同时,显著降低推理延迟。

Comments Accepted as an oral paper at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04717 2026-06-11 cs.CR cs.CY 版本更新 87%

Auditing CoT Answer-Hijack Patches: Source-Control Certificates with Type-I Guarantees

链式思维答案劫持的选择感知诊断

Jianwei Tai

专题命中 数学推理 :CoT(title,abstract);reasoning(abstract);chain-of-thought(abstract)

AI总结 针对链式思维答案劫持攻击,提出选择感知诊断方法,通过激活修补定位脆弱区域,并验证恢复依赖于同问题干净源。

详情

展开后加载摘要…

URL PDF HTML 收藏