arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 45051 信号源:cs.CL, cs.AI, cs.LG

1. 逻辑推理 3033 篇

2406.13803 2025-11-21 cs.CL 89%

LLMs as Models for Analogical Reasoning

大型语言模型作为类比推理模型

Sam Musker, Alex Duchnowski, Raphaël Millière, Ellie Pavlick

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL

AI总结 本文通过设计新的类比推理任务,探讨了大型语言模型在类比推理中的表现,发现其在某些条件下能匹配人类,但对特定变体反应不同,表明LLMs可能在某些领域提供可能的解释,但无法完全替代人类的类比能力。

Comments The title has been changed from Semantic Structure-Mapping in LLM and Human Analogical Reasoning to LLMs as Models for Analogical Reasoning to improve clarity and accuracy

Journal ref Journal of Memory and Language 145 (2025) 104676

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.15211 2025-06-19 cs.CL 89%

ProtoReasoning: Prototypes as the Foundation for Generalizable Reasoning in LLMs

Feng He, Zijun Chen, Xinnian Liang, Tingting Ma, Yunqi Qiu, Shuangzhi Wu, Junchi Yan

机构 * Shanghai Jiao Tong University(上海交通大学)

专题命中 逻辑推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);planning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06501 2026-08-21 cs.LG cs.CL 版本更新 88%

Transformer See, Transformer Do: Copying as an Intermediate Step in Learning Analogical Reasoning

Transformer 见,Transformer 作:复制作为学习类比推理的中间步骤

Philipp Hellwig, Willem Zuidema, Claire E. Stevenson, Martha Lewis

机构 * University of Amsterdam(阿姆斯特丹大学)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.LG

AI总结 本文研究了通过Meta-Learning for Compositionality训练的Transformer在类比推理任务中的表现,发现引入复制任务可提升模型对字母字符串类比的学习能力,并通过异质数据集训练提高了对新字母集的泛化能力。

Comments Accepted to COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16419 2026-08-18 cs.LG cs.AI q-bio.QM 新提交 88%

PertMind: Eliciting Emergent Biological Reasoning in LLM via Reinforcement Learning on Cellular Perturbation Data

PertMind:通过细胞扰动数据的强化学习在大语言模型中引出涌现生物推理能力

Zhenchao Tang, Xiaogang Xu, Tianxu Lv, Jiahui Guan, Jiale Zhou, Haohuai He, Zhi Song, Hanbo Huang, Jiehui Huang, Jiafei Wu, Zhe Liu

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.AI、cs.LG

AI总结 本研究提出PertMind模型,结合可信轨迹监督初始化与多层面强化信号,以细胞扰动图谱为强化学习环境训练,实现生物推理能力的涌现,且可迁移至多类生物任务。

Comments Project page: https://shapsider.github.io/PertMind/ Code: https://github.com/shapsider/PertMind Model: https://huggingface.co/tzcfly/PertMind

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21412 2026-08-12 cs.AI cs.CL cs.SE 版本更新 88%

Euclid-MCP: A Model Context Protocol Server for Deterministic Logical Reasoning via Prolog

欧几里得-MCP:一个通过Prolog进行确定性逻辑推理的模型上下文协议服务器

Bartolomeo Bogliolo

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 研究针对大型语言模型多步逻辑推理不可靠问题,提出开源的欧几里得-MCP服务器,通过引入欧几里得-IR及支持特定循环的工具接口实现确定性逻辑推理,经评估在处理大问题时效果优于LLMs,可作稳定推理基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23058 2026-07-28 cs.CL cs.AI 新提交 88%

ADAGE: A Language-Agnostic Pipeline for Analogical Reasoning Evaluation

ADAGE:一种用于类比推理评估的语言无关管道

Ahmed Haj Ahmed, Alvin Grissom

机构 * Haverford College(哈弗福德学院)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 研究针对多语言推理评估依赖翻译基准的问题,提出ADAGE语言无关管道,结合母语者策划与大语言模型辅助生成构建基准,通过为多种语言构建基准并评估模型,发现文化推理差距,还发布了相关内容。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24844 2026-06-30 cs.AI cs.CL 88%

Geo-Expert: Towards Expert-Level Geological Reasoning via Parameter-Efficient Fine-Tuning

Geo-Expert: 通过参数高效微调实现专家级地质推理

Chenyou Guo, Zongqi Liu, Yizhou Zhang, Zhaorui Jiang, Ze Liu

机构 * Ocean University of China(中国海洋大学) Peking University(北京大学) Monash University(墨尔本大学)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 本文提出Geo-Expert,通过参数高效微调(LoRA)在定制高质量指令数据集上微调小规模语言模型,在专门的地质推理基准Geo-Eval上,8B模型超越70B通用模型和GPT-4o,32B模型接近前沿推理模型。

Comments 11 pages, 1 figure, 3 tables. Accepted at ICML 2026 AI for Science Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21083 2026-06-23 cs.AI cs.LG 新提交 88%

Coherence Under Commitment: Probing Generalization and Vacuous Memorization in LLM Logical Reasoning

承诺下的一致性:探究LLM逻辑推理中的泛化与空洞记忆

Noor Islam S. Mohammad, Mahmudul Hasan

机构 * Department of Computer Science, Informatics Institute, Istanbul Technical University(伊斯坦布尔技术大学信息学研究所计算机科学系) School of Information Technology, Deakin University(迪肯大学信息技术学院)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.AI、cs.LG

AI总结 提出双查询评估范式CUC,联合测量一致性与决断力,揭示LLM通过系统性弃权实现空洞一致性的失败模式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03553 2026-06-23 cs.CL cs.AI 版本更新 88%

MultiZebraLogic: A Multilingual Logical Reasoning Benchmark

MultiZebraLogic:多语言逻辑推理基准

Sofie Helene Bruun, Dan Saattrup Smart

机构 * The Alexandra Institute(亚历山大研究所)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 提出多语言逻辑推理基准MultiZebraLogic,包含九种语言的高质量斑马谜题数据集,通过调整谜题大小和添加无关线索控制难度,分析语言、文化敏感性和线索类型对模型性能的影响。

Comments Camera-ready version for RESOURCEFUL 2026 at LREC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05143 2026-05-26 cs.CL cs.LG 88%

Feature Resemblance: Towards a Theoretical Understanding of Analogical Reasoning in Transformers

特征相似性:迈向对Transformer中类比推理的理论理解

Ruichen Xu, Wenjing Yan, Ying-Jun Angela Zhang

机构 * Department of Information Engineering, The Chinese University of Hong Kong, Hong Kong(香港中文大学信息工程系)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.LG

AI总结 本文通过最小化Transformer抽象模型,从理论上证明联合训练和特定课程顺序能使实体在表示空间中对齐,从而通过特征相似性实现属性转移,即类比推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11258 2026-05-13 cs.AI cs.CL q-bio.QM 88%

Unlocking LLM Creativity in Science through Analogical Reasoning

通过类比推理解锁大语言模型在科学中的创造力

Andrew Shen, Shaul Druckmann, James Zou

机构 * Stanford University(斯坦福大学)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 本文通过类比推理方法提升大语言模型在开放性问题解决中的多样性与创新性,实验表明该方法显著提高了生成解决方案的质量和多样性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18184 2026-05-12 cs.LG cs.AI 88%

ActivationReasoning: Logical Reasoning in Latent Activation Spaces

ActivationReasoning: 在潜在激活空间中的逻辑推理

Lukas Helff, Ruben Härle, Wolfgang Stammer, Felix Friedrich, Manuel Brack, Antonia Wüst, Hikaru Shindo, Patrick Schramowski, Kristian Kersting

机构 * TU Darmstadt(图恩-达姆施塔特大学) Lab1141(Lab1141实验室) Aleph Alpha Research(Aleph Alpha研究) MPI-Inf, SIC(马克斯·普朗克研究所(MPI-Inf)) Meta FAIR Adobe Applied Research(Adobe应用研究) DFKI(DFKI研究所) CERTAIN, Germany(德国CERTAIN)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出ActivationReasoning框架,通过在LLM的潜在空间中嵌入显式逻辑推理,提升模型的推理能力、可控性和对齐性,验证了在多跳推理、抽象与鲁棒性、自然语言推理及安全任务中的有效性。

Comments Proceedings of the 14th International Conference on Learning Representations (ICLR 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25346 2026-04-28 cs.AI cs.LG q-bio.CB q-bio.GN 88%

SynthPert: Enhancing LLM Biological Reasoning via Synthetic Reasoning Traces for Cellular Perturbation Prediction

SynthPert: 通过合成推理轨迹增强LLM的生物推理以进行细胞扰动预测

Lawrence Phillips, Marc Boubnovski Martell, Aditya Misra, Josefa Lia Stoisser, Cesar A. Prada-Medina, Rory Donovan-Maiye, Kaspar Märtens

机构 * InverseBio Novo Nordisk

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出SynthPert方法,通过合成推理轨迹提升LLM在细胞扰动预测中的性能,展现了合成数据在生物推理中的有效性,并实现了跨细胞类型泛化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19459 2026-04-22 cs.AI cs.CL cs.LO 88%

Do LLMs Game Formalization? Evaluating Faithfulness in Logical Reasoning

大语言模型是否在形式化中作弊?评估逻辑推理中的忠实性

Kyuhee Kim, Auguste Poiroux, Antoine Bosselut

机构 * EPFL(苏黎世联邦理工学院)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 本文评估了大语言模型在逻辑推理中的忠实性,发现统一生成方法在形式化过程中未表现出系统性作弊行为,但两种阶段流程揭示了两种不同的不忠实性模式。

Comments 25 pages, 4 figures, 22 tables. Published at the VerifAI-2 Workshop, ICLR 2026 (non-archival). Code and data: https://github.com/koreankiwi99/formalization-gaming

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29997 2026-04-01 cs.CL cs.AI 88%

Enhancing Structural Mapping with LLM-derived Abstractions for Analogical Reasoning in Narratives

通过LLM衍生抽象增强结构映射以提升叙事中的类比推理

Mohammadhossein Khojasteh, Yifan Jiang, Stefano De Giorgis, Frank van Harmelen, Filip Ilievski

机构 * Vrije Universiteit Amsterdam(阿姆斯特丹自由大学) University of Southern California(南加州大学)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 本文提出YARN框架,利用LLM分解叙事并抽象单元,提升叙事类比推理能力,实验表明抽象显著提升性能,揭示了抽象层级、隐含因果关系和类比模式分类的挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.04880 2026-03-31 quant-ph cs.AI cs.LG 88%

Symbolic Analysis of Grover Search Algorithm via Chain-of-Thought Reasoning and Quantum-Native Tokenization

通过链式推理和量子原生标记化对Grover搜索算法进行符号分析

Min Chen, Jinglei Cheng, Pingzhi Li, Haoran Wang, Tianlong Chen, Junyu Liu

机构 * Department of Computer Science, The University of Pittsburgh(匹兹堡大学计算机科学系) Department of Computer Science, The University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校计算机科学系)

专题命中 逻辑推理 :reasoning(title,abstract);chain-of-thought(title,abstract);分类 cs.AI、cs.LG

AI总结 本文探讨LLM通过符号分析解读量子电路的可行性,提出GroverGPT+模型,利用链式推理和量子原生标记化分析Grover算法,实现对oracle和标记状态的识别,并建立符号分析基准。

Comments 33 pages, 14 figures

Journal ref npj Quantum Information 12, 48 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.11190 2026-03-06 cs.AI cs.CL 88%

Enhancing multimodal analogical reasoning with Logic Augmented Generation

通过逻辑增强生成增强多模态类比推理

Anna Sofia Lippolis, Andrea Giovanni Nuzzolese, Aldo Gangemi

机构 * University of Bologna(博洛尼亚大学) ISTC-CNR(意大利国家研究 council 信息与系统技术研究中心)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 本文提出逻辑增强生成框架,通过结合语义知识图谱和提示启发法,提升多模态类比推理能力,在隐喻检测和理解任务中优于基线和人类表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.00043 2026-02-26 cs.CV cs.AI cs.CL 88%

VOILA: Evaluation of MLLMs For Perceptual Understanding and Analogical Reasoning

VOILA:对多模态大语言模型的感知理解与类比推理能力评估

Nilay Yilmaz, Maitreya Patel, Yiran Lawrence Luo, Tejas Gokhale, Chitta Baral, Suren Jayasuriya, Yezhou Yang

机构 * Arizona State University(亚利桑那州立大学) University of Maryland, Baltimore County(马里兰大学巴尔的摩县分校)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 VOILA通过类比映射方法评估多模态大语言模型的感知理解和抽象推理能力,发现其在图像间关系理解上存在不足,但通过多步提示策略可提升性能。

Comments Accepted at ICLR 2025. Code and data: https://github.com/nlylmz/Voila

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04260 2026-01-09 cs.AI cs.LG 88%

Towards a Mechanistic Understanding of Propositional Logical Reasoning in Large Language Models

迈向大型语言模型命题逻辑推理的机理理解

Danchun Chen, Qiyao Yan, Liangming Pan

机构 * MOE Key Lab of Computational Linguistics, Peking University(教育部计算语言学重点实验室,北京大学)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.AI、cs.LG

AI总结 本文通过分析Qwen3在PropLogic-MI数据集上的表现,揭示了大型语言模型在命题逻辑推理中采用的结构化计算机制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04810 2025-10-10 cs.CL cs.AI cs.LO 88%

Dissecting Logical Reasoning in LLMs: A Fine-Grained Evaluation and Supervision Study

Yujun Zhou, Jiayi Ye, Zipeng Ling, Yufei Han, Yue Huang, Haomin Zhuang, Zhenwen Liang, Kehan Guo, Taicheng Guo, Xiangqi Wang, Xiangliang Zhang

机构 * University of Notre Dame(诺丁汉大学) MBZUAI(马克斯·普朗克人工智能研究所) University of Pennsylvania(宾夕法尼亚大学) INRIA(法国国家信息与自动化研究所)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

Comments Accepted by the Findings of EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15652 2025-07-22 cs.AI cs.CL 88%

Empowering LLMs with Logical Reasoning: A Comprehensive Survey

Fengxiang Cheng, Haoxuan Li, Fenrong Liu, Robert van Rooij, Kun Zhang, Zhouchen Lin

机构 * Institute for Logic, Language and Computation, University of Amsterdam(阿姆斯特丹大学逻辑、语言与计算研究所) Center for Data Science, Peking University(北京大学数据科学中心) Tsinghua-UvA JRC for Logic, Department of Philosophy, Tsinghua University(清华大学哲学系) Machine Learning Department, MBZUAI(MBZUAI机器学习部门) Department of Philosophy, CMU(卡内基梅隆大学哲学系) State Key Lab of General AI, School of Intelligence Science and Technology, Peking University(北京大学人工智能通用实验室) Institute for Artificial Intelligence, Peking University(北京大学人工智能研究所) Pazhou Laboratory (Huangpu), Guangzhou(广州黄埔实验室)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

Comments Accepted by IJCAI 2025 (Survey Track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.01772 2025-07-18 cs.CL cs.AI 88%

DeFine: Decision-Making with Analogical Reasoning over Factor Profiles

Yebowen Hu, Xiaoyang Wang, Wenlin Yao, Yiming Lu, Daoan Zhang, Hassan Foroosh, Dong Yu, Fei Liu

机构 * University of Central Florida(中央佛罗里达大学) Tencent AI Lab, Seattle(腾讯AI实验室(西雅图)) University of Rochester(罗切斯特大学) Emory University(埃默里大学)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

Comments Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (ACL 2025), Vienna, Austria

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19641 2025-06-05 cs.AI cs.CL 88%

SynLogic: Synthesizing Verifiable Reasoning Data at Scale for Learning Logical Reasoning and Beyond

Junteng Liu, Yuanxiang Fan, Zhuo Jiang, Han Ding, Yongyi Hu, Chi Zhang, Yiqi Shi, Shitong Weng, Aili Chen, Shiqi Chen, Yunan Huang, Mozhi Zhang, Pengyu Zhao, Junjie Yan, Junxian He

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.09107 2025-04-22 cs.CL cs.AI 88%

GLoRE: Evaluating Logical Reasoning of Large Language Models

Hanmeng liu, Zhiyang Teng, Ruoxi Ning, Yiran Ding, Xiulai Li, Xiaozhang Liu, Yue Zhang

机构 * Hainan University(海南大学) Westlake University(西湖大学) ByteDance SG(字节跳动新加坡)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.12599 2025-04-18 cs.CL cs.AI 88%

Abstract Meaning Representation-Based Logic-Driven Data Augmentation for Logical Reasoning

Qiming Bao, Alex Yuxuan Peng, Zhenyun Deng, Wanjun Zhong, Gael Gendron, Timothy Pistotti, Neset Tan, Nathan Young, Yang Chen, Yonghua Zhu, Paul Denny, Michael Witbrock, Jiamou Liu

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

Comments 21 pages, 8 figures, the Findings of ACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.03666 2025-03-06 cs.CL cs.LG 88%

Analogical Reasoning Inside Large Language Models: Concept Vectors and the Limits of Abstraction

Gustaw Opiełka, Hannes Rosenbusch, Claire E. Stevenson

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.LG

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.09100 2025-02-14 cs.AI cs.CL 88%

Logical Reasoning in Large Language Models: A Survey

Hanmeng Liu, Zhizhang Fu, Mengru Ding, Ruoxi Ning, Chaoli Zhang, Xiaozhang Liu, Yue Zhang

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.09430 2025-01-20 cs.CL cs.AI 88%

Assessing and Enhancing the Robustness of Large Language Models with Task Structure Variations for Logical Reasoning

Qiming Bao, Gael Gendron, Alex Yuxuan Peng, Wanjun Zhong, Neset Tan, Yang Chen, Michael Witbrock, Jiamou Liu

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

Comments The short version (v3) was accepted for oral presentation at the first LLM@IJCAI 2023 non-archival symposium, and the full version was accepted by ICONIP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.12437 2024-12-18 cs.CL cs.LG 88%

Enhancing Logical Reasoning in Large Language Models through Graph-based Synthetic Data

Jiaming Zhou, Abbas Ghaddar, Ge Zhang, Liheng Ma, Yaochen Hu, Soumyasundar Pal, Mark Coates, Bin Wang, Yingxue Zhang, Jianye Hao

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.09207 2024-10-15 cs.AI cs.CL 88%

P-FOLIO: Evaluating and Improving Logical Reasoning with Abundant Human-Written Reasoning Chains

Simeng Han, Aaron Yu, Rui Shen, Zhenting Qi, Martin Riddell, Wenfei Zhou, Yujie Qiao, Yilun Zhao, Semih Yavuz, Ye Liu, Shafiq Joty, Yingbo Zhou, Caiming Xiong, Dragomir Radev, Rex Ying, Arman Cohan

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏