arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-04-01 至 2026-04-01 共收录 3 信号源:cs.CL, cs.AI, cs.LG

1. 数学推理 3 篇

2507.13266 2026-04-01 cs.CL cs.AI 84%

QuestA: Expanding Reasoning Capacity in LLMs via Question Augmentation

QuestA: 通过问题增强扩展大语言模型的推理能力

Jiazheng Li, Hongzhou Lin, Hong Lu, Kaiyue Wen, Zaiwen Yang, Jiaxuan Gao, Yi Wu, Jingzhao Zhang

机构 * Tsinghua University(清华大学) Shanghai Qi Zhi Institute(上海期智研究院) Amazon(亚马逊) Stanford University(斯坦福大学)

专题命中 数学推理 :reasoning(title,abstract);math reasoning(abstract);分类 cs.CL、cs.AI

AI总结 QuestA通过问题增强策略在训练中引入部分解以降低问题难度,提升大语言模型在数学推理任务中的推理能力,取得新的SOTA结果。

Comments 25 pages, 18 figures, ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19835 2026-04-01 cs.LG 83%

FIPO: Eliciting Deep Reasoning with Future-KL Influenced Policy Optimization

FIPO:通过未来KL影响的策略优化激发深度推理

Chiyu Ma, Shuo Yang, Kexin Huang, Jinda Lu, Haoming Meng, Shangshang Wang, Bolin Ding, Soroush Vosoughi, Guoyin Wang, Jingren Zhou

机构 * Alibaba Group(阿里巴巴集团)

专题命中 数学推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.LG

AI总结 FIPO通过引入折扣后的未来KL散度,改进策略更新,使模型突破传统基线的长度停滞,提升推理能力与准确率。

Comments Move related work to main paper, and add one more background information in Preliminary section

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03638 2026-04-01 cs.LG cs.AI math.RT stat.ML 73%

Expressive Power of Implicit Models: Rich Equilibria and Test-Time Scaling

隐式模型的表达能力:丰富的均衡与测试时扩展

Jialin Liu, Lisang Ding, Stanley Osher, Wotao Yin

机构 * University of Central Florida(中佛罗里达大学) University of California, Los Angeles(加利福尼亚大学洛杉矶分校) Decision Intelligence Lab, DAMO Academy, Alibaba US(达摩院决策智能实验室,阿里巴巴美国)

专题命中 数学推理 :reasoning(abstract);test-time compute(abstract);分类 cs.AI、cs.LG

AI总结 研究隐式模型通过非参数分析揭示其表达能力,证明其表达能力随测试时计算量增加而提升,验证了其在多个领域中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏