arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 1117 信号源:cs.CL, cs.AI, cs.LG

1. 代码与定理证明 1117 篇

2510.11986 2025-10-15 cs.CL cs.AI 81%

Conjecturing: An Overlooked Step in Formal Mathematical Reasoning

Jasivan Alex Sivakumar, Philipp Borchert, Ronald Cardenas, Gerasimos Lampouras

专题命中 代码与定理证明 :reasoning(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11572 2025-09-16 cs.AI cs.CL 81%

Formal Reasoning for Intelligent QA Systems: A Case Study in the Educational Domain

Tuan Bui, An Nguyen, Phat Thai, Minh Hua, Ngan Pham L. N., Ngan Pham T. B., Dung Le, Long Nguyen, Thanh-Tung Tran, Thang Bui, Tho Quan

机构 * Ho Chi Minh City University of Technology (HCMUT) - VNU-HCM(胡志明市技术大学(HCMUT)- VNU-HCM) International University - VNU-HCM(国际大学 - VNU-HCM)

专题命中 代码与定理证明 :reasoning(title,abstract);分类 cs.CL、cs.AI

Comments Published at the 2nd ACM Workshop in AI-powered Question & Answering Systems (AIQAM '25), co-located with ACM Multimedia 2025

Journal ref Proceedings of the 2nd ACM Workshop in AI-powered Question and Answering Systems (AIQAM '25), October 27-28, 2025, Dublin, Ireland

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06809 2025-09-09 cs.CL cs.AI 81%

Saturation-Driven Dataset Generation for LLM Mathematical Reasoning in the TPTP Ecosystem

Valentin Quesnel, Damien Sileo

专题命中 代码与定理证明 :reasoning(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19576 2025-09-09 cs.AI cs.LG 81%

ReST-RL: Achieving Accurate Code Reasoning of LLMs with Optimized Self-Training and Decoding

Sining Zhoubian, Dan Zhang, Jie Tang

机构 * The Knowledge Engineering Group (KEG), Tsinghua University(清华大学知识工程小组(KEG)、清华大学)

专题命中 代码与定理证明 :reasoning(title,abstract);分类 cs.AI、cs.LG

Comments 21 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19201 2025-08-27 cs.LG cs.AI stat.ML 81%

Understanding Tool-Integrated Reasoning

Heng Lin, Zhongwen Xu

专题命中 代码与定理证明 :reasoning(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17692 2025-08-26 cs.AI cs.CL 81%

LLM-based Agentic Reasoning Frameworks: A Survey from Methods to Scenarios

Bingxi Zhao, Lin Geng Foo, Ping Hu, Christian Theobalt, Hossein Rahmani, Jun Liu

机构 * Beijing Jiaotong University(北京交通大学) Lancaster University(兰卡斯特大学) Max Planck Institute for Informatics, Saarland Informatics Campus(马克斯·普朗克研究所(信息学)萨尔兰州信息学校区) University of Electronic Science and Technology of China(电子科技大学)

专题命中 代码与定理证明 :reasoning(title,abstract);分类 cs.CL、cs.AI

Comments 51 pages,10 figures,8 tables. Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04352 2025-08-26 cs.CL cs.AI 81%

Investigating the Robustness of Deductive Reasoning with Large Language Models

Fabian Hoppe, Filip Ilievski, Jan-Christoph Kalo

机构 * Vrije Universiteit Amsterdam(阿姆斯特丹自由大学) Universiteit van Amsterdam(阿姆斯特丹大学)

专题命中 代码与定理证明 :reasoning(title,abstract);分类 cs.CL、cs.AI

Comments to be published in ECAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11386 2025-08-18 cs.CL cs.AI cs.CY 81%

Retrieval-augmented reasoning with lean language models

Ryan Sze-Yin Chan, Federico Nanni, Tomas Lazauskas, Rosie Wood, Penelope Yong, Lionel Tarassenko, Mark Girolami, James Geddes, Andrew Duncan

机构 * The Alan Turing Institute(艾伦·图灵研究所) University of Oxford(牛津大学) University of Cambridge(剑桥大学) Imperial College London(伦敦帝国学院)

专题命中 代码与定理证明 :reasoning(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23754 2025-06-04 cs.CL cs.AI 81%

DeepTheorem: Advancing LLM Reasoning for Theorem Proving Through Natural Language and Reinforcement Learning

Ziyin Zhang, Jiahao Xu, Zhiwei He, Tian Liang, Qiuzhi Liu, Yansi Li, Linfeng Song, Zhenwen Liang, Zhuosheng Zhang, Rui Wang, Zhaopeng Tu, Haitao Mi, Dong Yu

专题命中 代码与定理证明 :reasoning(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13913 2025-05-29 cs.CL cs.AI 81%

How Do LLMs Perform Two-Hop Reasoning in Context?

Tianyu Guo, Hanlin Zhu, Ruiqi Zhang, Jiantao Jiao, Song Mei, Michael I. Jordan, Stuart Russell

机构 * Department of Statistics, UC Berkeley(统计学系,伯克利大学) Department of EECS, UC Berkeley(电子工程与计算机科学系,伯克利大学)

专题命中 代码与定理证明 :reasoning(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20047 2025-05-27 cs.CL cs.AI cs.LO cs.SE 81%

Grammars of Formal Uncertainty: When to Trust LLMs in Automated Reasoning Tasks

Debargha Ganguly, Vikash Singh, Sreehari Sankar, Biyao Zhang, Xuecen Zhang, Srinivasan Iyengar, Xiaotian Han, Amit Sharma, Shivkumar Kalyanaraman, Vipin Chaudhary

机构 * Case Western Reserve University(凯斯西储大学) Microsoft Corporation(微软公司) Microsoft Research(微软研究院)

专题命中 代码与定理证明 :reasoning(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.17216 2025-05-22 cs.AI cs.CL 81%

Intermediate Languages Matter: Formal Choice Drives Neurosymbolic LLM Reasoning

Alexander Beiser, David Penz, Nysret Musliu

机构 * TU Wien, Vienna, Austria(维也纳技术大学) Johannes Kepler University Linz, Linz, Austria(林茨约翰尼斯·凯普勒大学)

专题命中 代码与定理证明 :reasoning(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.09858 2025-04-15 cs.AI cs.CL 81%

Reasoning Models Can Be Effective Without Thinking

Wenjie Ma, Jingxuan He, Charlie Snell, Tyler Griggs, Sewon Min, Matei Zaharia

专题命中 代码与定理证明 :reasoning(title,abstract);分类 cs.CL、cs.AI

Comments 33 pages, 7 main figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.05518 2025-04-09 cs.SE cs.CL cs.LG 81%

Evaluating the Generalization Capabilities of Large Language Models on Code Reasoning

Rem Yang, Julian Dai, Nikos Vasilakis, Martin Rinard

专题命中 代码与定理证明 :reasoning(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.04110 2025-04-08 cs.AI cs.CL 81%

PEIRCE: Unifying Material and Formal Reasoning via LLM-Driven Neuro-Symbolic Refinement

Xin Quan, Marco Valentino, Danilo S. Carvalho, Dhairya Dalal, André Freitas

专题命中 代码与定理证明 :reasoning(title,abstract);分类 cs.CL、cs.AI

Comments Demo paper. Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.02976 2025-04-07 cs.LG cs.AI 81%

Localized Definitions and Distributed Reasoning: A Proof-of-Concept Mechanistic Interpretability Study via Activation Patching

Nooshin Bahador

专题命中 代码与定理证明 :reasoning(title,abstract);分类 cs.AI、cs.LG

Comments 15 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.24110 2025-04-01 cs.AI cs.CL 81%

Grounding Agent Reasoning in Image Schemas: A Neurosymbolic Approach to Embodied Cognition

François Olivier, Zied Bouraoui

专题命中 代码与定理证明 :reasoning(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.04740 2025-03-10 cs.CY cs.AI cs.LG 81%

PRISM: Perspective Reasoning for Integrated Synthesis and Mediation as a Multi-Perspective Framework for AI Alignment

Anthony Diamond

专题命中 代码与定理证明 :reasoning(title,abstract);分类 cs.AI、cs.LG

Comments 104 pages, 5 figures. Preprint on AI alignment presenting PRISM: a multi-perspective framework that organizes moral concerns into seven basis worldviews and uses Pareto-inspired synthesis to reconcile conflicting human values and specification gaming. Grounded in cognitive science and moral psychology

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.18548 2025-02-26 cs.LO cs.AI cs.CC cs.LG 81%

Transformer Encoder Satisfiability: Complexity and Impact on Formal Reasoning

Marco Sälzer, Eric Alsmann, Martin Lange

专题命中 代码与定理证明 :reasoning(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.16075 2024-12-23 cs.AI cs.LG cs.LO 81%

Formal Mathematical Reasoning: A New Frontier in AI

Kaiyu Yang, Gabriel Poesia, Jingxuan He, Wenda Li, Kristin Lauter, Swarat Chaudhuri, Dawn Song

专题命中 代码与定理证明 :reasoning(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.15296 2024-12-23 cs.CL cs.LG 81%

Confidence in the Reasoning of Large Language Models

Yudi Pawitan, Chris Holmes

专题命中 代码与定理证明 :reasoning(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.03778 2024-07-08 cs.AI cs.CL cs.HC 81%

From Data to Commonsense Reasoning: The Use of Large Language Models for Explainable AI

Stefanie Krause, Frieder Stolzenburg

专题命中 代码与定理证明 :reasoning(title,abstract);分类 cs.CL、cs.AI

Comments 19 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.13036 2024-05-24 cs.CL cs.AI 81%

Can formal argumentative reasoning enhance LLMs performances?

Federico Castagna, Isabel Sassoon, Simon Parsons

专题命中 代码与定理证明 :reasoning(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.01108 2024-02-05 cs.CL cs.LG 81%

Reasoning Capacity in Multi-Agent Systems: Limitations, Challenges and Human-Centered Solutions

Pouya Pezeshkpour, Eser Kandogan, Nikita Bhutani, Sajjadur Rahman, Tom Mitchell, Estevam Hruschka

专题命中 代码与定理证明 :reasoning(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.10663 2023-04-24 cs.CL cs.AI 81%

Meta Semantics: Towards better natural language understanding and reasoning

Xiaolin Hu

专题命中 代码与定理证明 :reasoning(title,abstract);分类 cs.CL、cs.AI

Comments 10 pages, 8 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2205.10714 2022-05-25 cs.CL cs.AI 81%

Interpretable Proof Generation via Iterative Backward Reasoning

Hanhao Qu, Yu Cao, Jun Gao, Liang Ding, Ruifeng Xu

专题命中 代码与定理证明 :reasoning(title,abstract);分类 cs.CL、cs.AI

Comments NAACL-HLT 2022 (Long), 14 pages (2 page references + 3 page appendix)

详情

展开后加载摘要…

URL PDF HTML 收藏
1908.08184 2019-08-23 cs.AI cs.LG 81%

Report on the First Knowledge Graph Reasoning Challenge 2018 -- Toward the eXplainable AI System

Takahiro Kawamura, Shusaku Egami, Koutarou Tamura, Yasunori Hokazono, Takanori Ugai, Yusuke Koyanagi, Fumihito Nishino, Seiji Okajima, Katsuhiko Murakami, Kunihiko Takamatsu, Aoi Sugiura, Shun Shiramatsu, Shawn Zhang, Kouji Kozaki

专题命中 代码与定理证明 :reasoning(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1901.08162 2019-01-25 cs.LG cs.AI stat.ML 81%

Causal Reasoning from Meta-reinforcement Learning

Ishita Dasgupta, Jane Wang, Silvia Chiappa, Jovana Mitrovic, Pedro Ortega, David Raposo, Edward Hughes, Peter Battaglia, Matthew Botvinick, Zeb Kurth-Nelson

专题命中 代码与定理证明 :reasoning(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1804.04452 2018-04-13 stat.ML cs.AI cs.LG 81%

Solving Bongard Problems with a Visual Language and Pragmatic Reasoning

Stefan Depeweg, Constantin A. Rothkopf, Frank Jäkel

专题命中 代码与定理证明 :reasoning(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1311.4639 2013-11-20 cs.AI cs.LG cs.LO 81%

Post-Proceedings of the First International Workshop on Learning and Nonmonotonic Reasoning

Katsumi Inoue, Chiaki Sakama

专题命中 代码与定理证明 :reasoning(title,abstract);分类 cs.AI、cs.LG

Comments 67 pages, 5 papers, 1 abstract, 1 cover

详情

展开后加载摘要…

URL PDF HTML 收藏