arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 3002 信号源:cs.CL, cs.AI, cs.LG

1. 逻辑推理 3002 篇

2607.23058 2026-07-28 cs.CL cs.AI 新提交 88%

ADAGE: A Language-Agnostic Pipeline for Analogical Reasoning Evaluation

ADAGE:一种用于类比推理评估的语言无关管道

Ahmed Haj Ahmed, Alvin Grissom

机构 * Haverford College(哈弗福德学院)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 研究针对多语言推理评估依赖翻译基准的问题,提出ADAGE语言无关管道,结合母语者策划与大语言模型辅助生成构建基准,通过为多种语言构建基准并评估模型,发现文化推理差距,还发布了相关内容。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24844 2026-06-30 cs.AI cs.CL 88%

Geo-Expert: Towards Expert-Level Geological Reasoning via Parameter-Efficient Fine-Tuning

Geo-Expert: 通过参数高效微调实现专家级地质推理

Chenyou Guo, Zongqi Liu, Yizhou Zhang, Zhaorui Jiang, Ze Liu

机构 * Ocean University of China(中国海洋大学) Peking University(北京大学) Monash University(墨尔本大学)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 本文提出Geo-Expert,通过参数高效微调(LoRA)在定制高质量指令数据集上微调小规模语言模型,在专门的地质推理基准Geo-Eval上,8B模型超越70B通用模型和GPT-4o,32B模型接近前沿推理模型。

Comments 11 pages, 1 figure, 3 tables. Accepted at ICML 2026 AI for Science Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21083 2026-06-23 cs.AI cs.LG 新提交 88%

Coherence Under Commitment: Probing Generalization and Vacuous Memorization in LLM Logical Reasoning

承诺下的一致性:探究LLM逻辑推理中的泛化与空洞记忆

Noor Islam S. Mohammad, Mahmudul Hasan

机构 * Department of Computer Science, Informatics Institute, Istanbul Technical University(伊斯坦布尔技术大学信息学研究所计算机科学系) School of Information Technology, Deakin University(迪肯大学信息技术学院)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.AI、cs.LG

AI总结 提出双查询评估范式CUC,联合测量一致性与决断力,揭示LLM通过系统性弃权实现空洞一致性的失败模式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03553 2026-06-23 cs.CL cs.AI 版本更新 88%

MultiZebraLogic: A Multilingual Logical Reasoning Benchmark

MultiZebraLogic:多语言逻辑推理基准

Sofie Helene Bruun, Dan Saattrup Smart

机构 * The Alexandra Institute(亚历山大研究所)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 提出多语言逻辑推理基准MultiZebraLogic,包含九种语言的高质量斑马谜题数据集,通过调整谜题大小和添加无关线索控制难度,分析语言、文化敏感性和线索类型对模型性能的影响。

Comments Camera-ready version for RESOURCEFUL 2026 at LREC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05143 2026-05-26 cs.CL cs.LG 88%

Feature Resemblance: Towards a Theoretical Understanding of Analogical Reasoning in Transformers

特征相似性:迈向对Transformer中类比推理的理论理解

Ruichen Xu, Wenjing Yan, Ying-Jun Angela Zhang

机构 * Department of Information Engineering, The Chinese University of Hong Kong, Hong Kong(香港中文大学信息工程系)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.LG

AI总结 本文通过最小化Transformer抽象模型,从理论上证明联合训练和特定课程顺序能使实体在表示空间中对齐,从而通过特征相似性实现属性转移,即类比推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11258 2026-05-13 cs.AI cs.CL q-bio.QM 88%

Unlocking LLM Creativity in Science through Analogical Reasoning

通过类比推理解锁大语言模型在科学中的创造力

Andrew Shen, Shaul Druckmann, James Zou

机构 * Stanford University(斯坦福大学)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 本文通过类比推理方法提升大语言模型在开放性问题解决中的多样性与创新性,实验表明该方法显著提高了生成解决方案的质量和多样性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18184 2026-05-12 cs.LG cs.AI 88%

ActivationReasoning: Logical Reasoning in Latent Activation Spaces

ActivationReasoning: 在潜在激活空间中的逻辑推理

Lukas Helff, Ruben Härle, Wolfgang Stammer, Felix Friedrich, Manuel Brack, Antonia Wüst, Hikaru Shindo, Patrick Schramowski, Kristian Kersting

机构 * TU Darmstadt(图恩-达姆施塔特大学) Lab1141(Lab1141实验室) Aleph Alpha Research(Aleph Alpha研究) MPI-Inf, SIC(马克斯·普朗克研究所(MPI-Inf)) Meta FAIR Adobe Applied Research(Adobe应用研究) DFKI(DFKI研究所) CERTAIN, Germany(德国CERTAIN)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出ActivationReasoning框架,通过在LLM的潜在空间中嵌入显式逻辑推理,提升模型的推理能力、可控性和对齐性,验证了在多跳推理、抽象与鲁棒性、自然语言推理及安全任务中的有效性。

Comments Proceedings of the 14th International Conference on Learning Representations (ICLR 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25346 2026-04-28 cs.AI cs.LG q-bio.CB q-bio.GN 88%

SynthPert: Enhancing LLM Biological Reasoning via Synthetic Reasoning Traces for Cellular Perturbation Prediction

SynthPert: 通过合成推理轨迹增强LLM的生物推理以进行细胞扰动预测

Lawrence Phillips, Marc Boubnovski Martell, Aditya Misra, Josefa Lia Stoisser, Cesar A. Prada-Medina, Rory Donovan-Maiye, Kaspar Märtens

机构 * InverseBio Novo Nordisk

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出SynthPert方法,通过合成推理轨迹提升LLM在细胞扰动预测中的性能,展现了合成数据在生物推理中的有效性,并实现了跨细胞类型泛化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19459 2026-04-22 cs.AI cs.CL cs.LO 88%

Do LLMs Game Formalization? Evaluating Faithfulness in Logical Reasoning

大语言模型是否在形式化中作弊?评估逻辑推理中的忠实性

Kyuhee Kim, Auguste Poiroux, Antoine Bosselut

机构 * EPFL(苏黎世联邦理工学院)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 本文评估了大语言模型在逻辑推理中的忠实性,发现统一生成方法在形式化过程中未表现出系统性作弊行为,但两种阶段流程揭示了两种不同的不忠实性模式。

Comments 25 pages, 4 figures, 22 tables. Published at the VerifAI-2 Workshop, ICLR 2026 (non-archival). Code and data: https://github.com/koreankiwi99/formalization-gaming

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06501 2026-04-09 cs.LG cs.CL 88%

Transformer See, Transformer Do: Copying as an Intermediate Step in Learning Analogical Reasoning

Transformer 见,Transformer 作:复制作为学习类比推理的中间步骤

Philipp Hellwig, Willem Zuidema, Claire E. Stevenson, Martha Lewis

机构 * University of Amsterdam(阿姆斯特丹大学)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.LG

AI总结 本文研究了通过Meta-Learning for Compositionality训练的Transformer在类比推理任务中的表现,发现引入复制任务可提升模型对字母字符串类比的学习能力,并通过异质数据集训练提高了对新字母集的泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29997 2026-04-01 cs.CL cs.AI 88%

Enhancing Structural Mapping with LLM-derived Abstractions for Analogical Reasoning in Narratives

通过LLM衍生抽象增强结构映射以提升叙事中的类比推理

Mohammadhossein Khojasteh, Yifan Jiang, Stefano De Giorgis, Frank van Harmelen, Filip Ilievski

机构 * Vrije Universiteit Amsterdam(阿姆斯特丹自由大学) University of Southern California(南加州大学)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 本文提出YARN框架,利用LLM分解叙事并抽象单元,提升叙事类比推理能力,实验表明抽象显著提升性能,揭示了抽象层级、隐含因果关系和类比模式分类的挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.04880 2026-03-31 quant-ph cs.AI cs.LG 88%

Symbolic Analysis of Grover Search Algorithm via Chain-of-Thought Reasoning and Quantum-Native Tokenization

通过链式推理和量子原生标记化对Grover搜索算法进行符号分析

Min Chen, Jinglei Cheng, Pingzhi Li, Haoran Wang, Tianlong Chen, Junyu Liu

机构 * Department of Computer Science, The University of Pittsburgh(匹兹堡大学计算机科学系) Department of Computer Science, The University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校计算机科学系)

专题命中 逻辑推理 :reasoning(title,abstract);chain-of-thought(title,abstract);分类 cs.AI、cs.LG

AI总结 本文探讨LLM通过符号分析解读量子电路的可行性,提出GroverGPT+模型,利用链式推理和量子原生标记化分析Grover算法,实现对oracle和标记状态的识别,并建立符号分析基准。

Comments 33 pages, 14 figures

Journal ref npj Quantum Information 12, 48 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.11190 2026-03-06 cs.AI cs.CL 88%

Enhancing multimodal analogical reasoning with Logic Augmented Generation

通过逻辑增强生成增强多模态类比推理

Anna Sofia Lippolis, Andrea Giovanni Nuzzolese, Aldo Gangemi

机构 * University of Bologna(博洛尼亚大学) ISTC-CNR(意大利国家研究 council 信息与系统技术研究中心)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 本文提出逻辑增强生成框架,通过结合语义知识图谱和提示启发法,提升多模态类比推理能力,在隐喻检测和理解任务中优于基线和人类表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.00043 2026-02-26 cs.CV cs.AI cs.CL 88%

VOILA: Evaluation of MLLMs For Perceptual Understanding and Analogical Reasoning

VOILA:对多模态大语言模型的感知理解与类比推理能力评估

Nilay Yilmaz, Maitreya Patel, Yiran Lawrence Luo, Tejas Gokhale, Chitta Baral, Suren Jayasuriya, Yezhou Yang

机构 * Arizona State University(亚利桑那州立大学) University of Maryland, Baltimore County(马里兰大学巴尔的摩县分校)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 VOILA通过类比映射方法评估多模态大语言模型的感知理解和抽象推理能力,发现其在图像间关系理解上存在不足,但通过多步提示策略可提升性能。

Comments Accepted at ICLR 2025. Code and data: https://github.com/nlylmz/Voila

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04260 2026-01-09 cs.AI cs.LG 88%

Towards a Mechanistic Understanding of Propositional Logical Reasoning in Large Language Models

迈向大型语言模型命题逻辑推理的机理理解

Danchun Chen, Qiyao Yan, Liangming Pan

机构 * MOE Key Lab of Computational Linguistics, Peking University(教育部计算语言学重点实验室,北京大学)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.AI、cs.LG

AI总结 本文通过分析Qwen3在PropLogic-MI数据集上的表现,揭示了大型语言模型在命题逻辑推理中采用的结构化计算机制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04810 2025-10-10 cs.CL cs.AI cs.LO 88%

Dissecting Logical Reasoning in LLMs: A Fine-Grained Evaluation and Supervision Study

Yujun Zhou, Jiayi Ye, Zipeng Ling, Yufei Han, Yue Huang, Haomin Zhuang, Zhenwen Liang, Kehan Guo, Taicheng Guo, Xiangqi Wang, Xiangliang Zhang

机构 * University of Notre Dame(诺丁汉大学) MBZUAI(马克斯·普朗克人工智能研究所) University of Pennsylvania(宾夕法尼亚大学) INRIA(法国国家信息与自动化研究所)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

Comments Accepted by the Findings of EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15652 2025-07-22 cs.AI cs.CL 88%

Empowering LLMs with Logical Reasoning: A Comprehensive Survey

Fengxiang Cheng, Haoxuan Li, Fenrong Liu, Robert van Rooij, Kun Zhang, Zhouchen Lin

机构 * Institute for Logic, Language and Computation, University of Amsterdam(阿姆斯特丹大学逻辑、语言与计算研究所) Center for Data Science, Peking University(北京大学数据科学中心) Tsinghua-UvA JRC for Logic, Department of Philosophy, Tsinghua University(清华大学哲学系) Machine Learning Department, MBZUAI(MBZUAI机器学习部门) Department of Philosophy, CMU(卡内基梅隆大学哲学系) State Key Lab of General AI, School of Intelligence Science and Technology, Peking University(北京大学人工智能通用实验室) Institute for Artificial Intelligence, Peking University(北京大学人工智能研究所) Pazhou Laboratory (Huangpu), Guangzhou(广州黄埔实验室)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

Comments Accepted by IJCAI 2025 (Survey Track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.01772 2025-07-18 cs.CL cs.AI 88%

DeFine: Decision-Making with Analogical Reasoning over Factor Profiles

Yebowen Hu, Xiaoyang Wang, Wenlin Yao, Yiming Lu, Daoan Zhang, Hassan Foroosh, Dong Yu, Fei Liu

机构 * University of Central Florida(中央佛罗里达大学) Tencent AI Lab, Seattle(腾讯AI实验室(西雅图)) University of Rochester(罗切斯特大学) Emory University(埃默里大学)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

Comments Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (ACL 2025), Vienna, Austria

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19641 2025-06-05 cs.AI cs.CL 88%

SynLogic: Synthesizing Verifiable Reasoning Data at Scale for Learning Logical Reasoning and Beyond

Junteng Liu, Yuanxiang Fan, Zhuo Jiang, Han Ding, Yongyi Hu, Chi Zhang, Yiqi Shi, Shitong Weng, Aili Chen, Shiqi Chen, Yunan Huang, Mozhi Zhang, Pengyu Zhao, Junjie Yan, Junxian He

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.09107 2025-04-22 cs.CL cs.AI 88%

GLoRE: Evaluating Logical Reasoning of Large Language Models

Hanmeng liu, Zhiyang Teng, Ruoxi Ning, Yiran Ding, Xiulai Li, Xiaozhang Liu, Yue Zhang

机构 * Hainan University(海南大学) Westlake University(西湖大学) ByteDance SG(字节跳动新加坡)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.12599 2025-04-18 cs.CL cs.AI 88%

Abstract Meaning Representation-Based Logic-Driven Data Augmentation for Logical Reasoning

Qiming Bao, Alex Yuxuan Peng, Zhenyun Deng, Wanjun Zhong, Gael Gendron, Timothy Pistotti, Neset Tan, Nathan Young, Yang Chen, Yonghua Zhu, Paul Denny, Michael Witbrock, Jiamou Liu

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

Comments 21 pages, 8 figures, the Findings of ACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.03666 2025-03-06 cs.CL cs.LG 88%

Analogical Reasoning Inside Large Language Models: Concept Vectors and the Limits of Abstraction

Gustaw Opiełka, Hannes Rosenbusch, Claire E. Stevenson

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.LG

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.09100 2025-02-14 cs.AI cs.CL 88%

Logical Reasoning in Large Language Models: A Survey

Hanmeng Liu, Zhizhang Fu, Mengru Ding, Ruoxi Ning, Chaoli Zhang, Xiaozhang Liu, Yue Zhang

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.09430 2025-01-20 cs.CL cs.AI 88%

Assessing and Enhancing the Robustness of Large Language Models with Task Structure Variations for Logical Reasoning

Qiming Bao, Gael Gendron, Alex Yuxuan Peng, Wanjun Zhong, Neset Tan, Yang Chen, Michael Witbrock, Jiamou Liu

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

Comments The short version (v3) was accepted for oral presentation at the first LLM@IJCAI 2023 non-archival symposium, and the full version was accepted by ICONIP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.12437 2024-12-18 cs.CL cs.LG 88%

Enhancing Logical Reasoning in Large Language Models through Graph-based Synthetic Data

Jiaming Zhou, Abbas Ghaddar, Ge Zhang, Liheng Ma, Yaochen Hu, Soumyasundar Pal, Mark Coates, Bin Wang, Yingxue Zhang, Jianye Hao

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.09207 2024-10-15 cs.AI cs.CL 88%

P-FOLIO: Evaluating and Improving Logical Reasoning with Abundant Human-Written Reasoning Chains

Simeng Han, Aaron Yu, Rui Shen, Zhenting Qi, Martin Riddell, Wenfei Zhou, Yujie Qiao, Yilun Zhao, Semih Yavuz, Ye Liu, Shafiq Joty, Yingbo Zhou, Caiming Xiong, Dragomir Radev, Rex Ying, Arman Cohan

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.00757 2024-10-10 cs.SE cs.AI cs.CL cs.LO 88%

LogicAsker: Evaluating and Improving the Logical Reasoning Ability of Large Language Models

Yuxuan Wan, Wenxuan Wang, Yiliu Yang, Youliang Yuan, Jen-tse Huang, Pinjia He, Wenxiang Jiao, Michael R. Lyu

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

Comments Accepted by EMNLP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.07034 2024-06-12 cs.AI cs.CL 88%

Improving Multi-hop Logical Reasoning in Knowledge Graphs with Context-Aware Query Representation Learning

Jeonghoon Kim, Heesoo Jung, Hyeju Jang, Hogun Park

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

Comments Accepted to ACL 2024 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.18659 2024-05-28 cs.AI cs.CL 88%

DetermLR: Augmenting LLM-based Logical Reasoning from Indeterminacy to Determinacy

Hongda Sun, Weikai Xu, Wei Liu, Jian Luan, Bin Wang, Shuo Shang, Ji-Rong Wen, Rui Yan

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

Comments Accepted at ACL 2024 Main, Code repo: https://github.com/XiaoMi/DetermLR

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.05994 2024-05-20 cs.CL cs.AI 88%

ANALOGYKB: Unlocking Analogical Reasoning of Language Models with A Million-scale Knowledge Base

Siyu Yuan, Jiangjie Chen, Changzhi Sun, Jiaqing Liang, Yanghua Xiao, Deqing Yang

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

Comments Accepted to ACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏