arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 3002 信号源:cs.CL, cs.AI, cs.LG

1. 逻辑推理 3002 篇

2404.13070 2024-05-01 cs.CL cs.AI 88%

Evidence from counterfactual tasks supports emergent analogical reasoning in large language models

Taylor Webb, Keith J. Holyoak, Hongjing Lu

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.04293 2024-04-09 cs.CL cs.AI 88%

Reason from Fallacy: Enhancing Large Language Models' Logical Reasoning through Logical Fallacy Understanding

Yanda Li, Dixuan Wang, Jiaqing Liang, Guochao Jiang, Qianyu He, Yanghua Xiao, Deqing Yang

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.07954 2024-03-26 cs.AI cs.CL 88%

A Closer Look at the Self-Verification Abilities of Large Language Models in Logical Reasoning

Ruixin Hong, Hongming Zhang, Xinyu Pang, Dong Yu, Changshui Zhang

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

Comments NAACL 2024 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.12023 2024-02-19 cs.CL cs.AI 88%

Logical Reasoning over Natural Language as Knowledge Representation: A Survey

Zonglin Yang, Xinya Du, Rui Mao, Jinjie Ni, Erik Cambria

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.08955 2024-02-15 cs.AI cs.CL 88%

Using Counterfactual Tasks to Evaluate the Generality of Analogical Reasoning in Large Language Models

Martha Lewis, Melanie Mitchell

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.13179 2024-02-12 cs.CL cs.AI 88%

Teaching Probabilistic Logical Reasoning to Transformers

Aliakbar Nafar, Kristen Brent Venable, Parisa Kordjamshidi

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

Comments This work is part of the proceedings of EACL Findings 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.13095 2023-11-23 cs.CL cs.AI 88%

Enhancing Logical Reasoning in Large Language Models to Facilitate Legal Applications

Ha-Thanh Nguyen, Wachara Fungwacharakorn, Ken Satoh

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

Comments ALP@JURIX2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.13566 2023-10-23 cs.CL cs.AI 88%

Retrieval-Augmented Neural Response Generation Using Logical Reasoning and Relevance Scoring

Nicholas Thomas Walker, Stefan Ultes, Pierre Lison

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

Comments Presented at SemDial, August 2023 in Maribor, Slovenia

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.15273 2023-06-28 cs.CL cs.AI 88%

IDOL: Indicator-oriented Logic Pre-training for Logical Reasoning

Zihang Xu, Ziqing Yang, Yiming Cui, Shijin Wang

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

Comments Accepted to the Findings of ACL 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.03439 2023-05-08 cs.CL cs.AI 88%

Evaluating the Logical Reasoning Ability of ChatGPT and GPT-4

Hanmeng Liu, Ruoxi Ning, Zhiyang Teng, Jian Liu, Qiji Zhou, Yue Zhang

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.12487 2022-10-25 cs.AI cs.CL cs.LO 88%

MetaLogic: Logical Reasoning Explanations with Fine-Grained Structure

Yinya Huang, Hongming Zhang, Ruixin Hong, Xiaodan Liang, Changshui Zhang, Dong Yu

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

Comments To appear at the main conference of EMNLP 2022

Journal ref EMNLP 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.02729 2022-10-25 cs.CL cs.LG 88%

Join-Chain Network: A Logical Reasoning View of the Multi-head Attention in Transformer

Jianyi Zhang, Yiran Chen, Jianshu Chen

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.LG

Comments Accepted by 2022 IEEE International Conference on Data Mining (ICDM 2022) Workshop on Foundation Models for Vision and Language

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.00620 2022-10-04 cs.AI cs.CL 88%

Does Wikidata Support Analogical Reasoning?

Filip Ilievski, Jay Pujara, Kartik Shenoy

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2205.09712 2022-05-20 cs.AI cs.CL 88%

Selection-Inference: Exploiting Large Language Models for Interpretable Logical Reasoning

Antonia Creswell, Murray Shanahan, Irina Higgins

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2202.04161 2022-02-10 cs.CL cs.AI 88%

Logical Reasoning for Task Oriented Dialogue Systems

Sajjad Beygi, Maryam Fazel-Zarandi, Alessandra Cervone, Prakash Krishnan, Siddhartha Reddy Jonnalagadda

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2007.11668 2020-07-24 cs.CL cs.AI cs.CV cs.RO 88%

Analogical Reasoning for Visually Grounded Language Acquisition

Bo Wu, Haoyu Qin, Alireza Zareian, Carl Vondrick, Shih-Fu Chang

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

Comments 12 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
1905.12149 2019-05-30 cs.LG cs.AI stat.ML 88%

SATNet: Bridging deep learning and logical reasoning using a differentiable satisfiability solver

Po-Wei Wang, Priya L. Donti, Bryan Wilder, Zico Kolter

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.AI、cs.LG

Comments Accepted at ICML'19. The code can be found at https://github.com/locuslab/satnet

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.01157 2024-04-02 cs.LO cs.AI cs.IR 88%

Complex Logical Reasoning over Knowledge Graphs using Large Language Models

Nurendra Choudhary, Chandan K. Reddy

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.AI

Comments Code available at https://github.com/Akirato/LLM-KG-Reasoning

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.10454 2023-08-22 cs.AI cs.CY cs.HC 88%

Elucidating STEM Concepts through Generative AI: A Multi-modal Exploration of Analogical Reasoning

Chen Cao, Zijian Ding, Gyeong-Geon Lee, Jiajun Jiao, Jionghao Lin, Xiaoming Zhai

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.AI

Journal ref IJCAI2023 Symposium on Multimodal Reasoning with LLM

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00583 2026-08-04 cs.CR cs.AI cs.CL cs.LG 新提交 88%

A False Average: Chain-of-Thought Monitors Collapse Where They Are the Only Defense

虚假的平均值:思维链监控在其作为唯一防御的地方失效

Shikhar Shiromani, Leo Richter

专题命中 逻辑推理 :chain-of-thought(title,abstract);CoT(abstract,abstract_cn);reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 该研究指出思维链监控在作为唯一防御时会失效,攻击者通过重写智能体推理可大幅降低监控捕获率,攻击可跨模型迁移,仅轨迹防御难恢复,需外部信息辅助。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00341 2026-07-28 cs.CL cs.AI cs.LG 版本更新 88%

DiscoLoop: Looping Discrete Embeddings and Continuous Hidden States for Multi-hop Reasoning

DiscoLoop: 循环离散嵌入与连续隐藏状态用于多跳推理

Hengyu Fu, Tianyu Guo, Zixuan Wang, Hanlin Zhu, Jason D. Lee, Jiantao Jiao, Stuart Russell, Song Mei

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 逻辑推理 :reasoning(title,abstract);CoT(abstract,abstract_cn);chain-of-thought(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 针对多跳推理中非循环Transformer的深度局部存储问题,提出DiscoLoop架构,通过循环同时携带离散嵌入和连续隐藏状态,实现近乎完美的泛化,并在符号和合成语言任务中显著减少训练步数。

Comments 16 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06940 2026-06-11 eess.AS cs.SD 版本更新 88%

Beyond Semantic Dominance: Cognitive Affective Reasoning and Empathetic Response Alignment in Audio Language Models

超越语义主导:音频语言模型中的认知情感推理与共情响应对齐

Zhixian Zhao, Shuiyuan Wang, Wenjie Tian, Jingbin Hu, Ziyu Zhang, Lei Xie

机构 * Northwestern Polytechnical University(西北工业大学)

专题命中 逻辑推理 :reasoning(title,abstract);CoT(abstract,abstract_cn);chain-of-thought(abstract);logical reasoning(abstract)

AI总结 提出CogAudio-LLM框架,通过构建LIME-440K数据集实现声学-语义解耦,设计EIPS思维链机制进行心理推理,并采用DR-SAPO优化策略平衡逻辑严谨性与共情质量,解决音频语言模型中的语义主导和情感认知不足问题。

Comments Accepted by Interspeech2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.04697 2025-10-06 cs.CL cs.AI cs.LG 88%

L1: Controlling How Long A Reasoning Model Thinks With Reinforcement Learning

Pranjal Aggarwal, Sean Welleck

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 逻辑推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);test-time compute(abstract)

Comments Accepted at COLM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.04652 2024-08-12 cs.CL cs.AI cs.LG 88%

Leveraging Large Language Models with Chain-of-Thought and Prompt Engineering for Traffic Crash Severity Analysis and Inference

Hao Zhen, Yucheng Shi, Yongcan Huang, Jidong J. Yang, Ninghao Liu

专题命中 逻辑推理 :chain-of-thought(title,abstract);reasoning(abstract);CoT(abstract);logical reasoning(abstract)

Comments 20 pages, 12 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.12348 2024-06-11 cs.CL cs.AI cs.LG 88%

GTBench: Uncovering the Strategic Reasoning Limitations of LLMs via Game-Theoretic Evaluations

Jinhao Duan, Renming Zhang, James Diffenderfer, Bhavya Kailkhura, Lichao Sun, Elias Stengel-Eskin, Mohit Bansal, Tianlong Chen, Kaidi Xu

专题命中 逻辑推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);logical reasoning(abstract)

Comments 26 pages; the first two authors contributed equally; GTBench HF Leaderboard: https://huggingface.co/spaces/GTBench/GTBench

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.19176 2025-10-23 cs.AI cs.CL 88%

The Zero-Step Thinking: An Empirical Study of Mode Selection as Harder Early Exit in Reasoning Models

Yuqiao Tan, Shizhu He, Kang Liu, Jun Zhao

机构 * The Key Laboratory of Cognition and Decision Intelligence for Complex Systems, Institute of Automation, Chinese Academy of Sciences(认知与决策智能复杂系统重点实验室,自动化研究所,中国科学院) School of Artificial Intelligence, University of Chinese Academy of Sciences(人工智能学院,中国科学院大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 逻辑推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);logical reasoning(abstract)

Comments Accepted by NeurIPS'25 Efficient Reasoning Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21933 2026-07-27 cs.AI 新提交 88%

Semiotic logical hexagon theory for LLM logical reasoning

用于大语言模型逻辑推理的符号逻辑六边形理论

Yunyao Zhang, Xinglang Zhang, Zeliang Chen, Junqing Yu, Zikai Song

机构 * Huazhong University of Science and Technology(华中科技大学)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.AI

AI总结 研究大语言模型逻辑推理中语义组织的影响,提出HexLogicAgent框架,先组织自然语言含义再结构化验证推理。发现不完整语义表示是推理失败主因,建模语义对立结构可延迟性能下降,实验证明该框架能提高推理可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26454 2026-07-21 cs.AI 版本更新 88%

Data-driven Machine Learning Cannot Reach Symbolic-level Logical Reasoning -- The Limit of the Scaling Law

数据驱动的机器学习无法达到符号级逻辑推理——缩放定律的极限

Tiansi Dong, Mateja Jamnik, Pietro Liò

机构 * The Alan Turing Institute(艾伦·图灵研究所) University of Cambridge(剑桥大学)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.AI

AI总结 本文通过理论分析和实验证明,数据驱动的监督深度学习无法通过增加训练数据和时间达到符号级三段论推理的严谨性,并揭示了训练数据和方法上的根本限制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16517 2026-07-01 cs.LG q-bio.QM 新提交 88%

How Post-Training Shapes Biological Reasoning Models

后训练如何塑造生物学推理模型

Lukas Fesser, Hanlin Zhang, Michelle M. Li, Eric Wang, Bryan Perozzi, Shekoofeh Azizi, Sham M. Kakade, Marinka Zitnik

机构 * Harvard University(哈佛大学) Google DeepMind(谷歌DeepMind) Google Research(谷歌研究院)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.LG

AI总结 研究后训练各阶段(CPT、SFT、RL)对生物学推理模型领域内和领域外性能的影响,发现SFT提升领域内性能但损害泛化,RL可部分恢复泛化,最佳策略是短SFT加长RL。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23238 2026-06-24 cs.AI 新提交 88%

HOLMES: Evaluating Higher-Order Logical Reasoning in LLMs

HOLMES: 评估大语言模型中的高阶逻辑推理

Yucheng Wu, Jundong Xu, Mingzhen Ju, Yue Yu, Chenpeng Wang, Haoxuan Li, Liangming Pan

机构 * State Key Laboratory of Multimedia Information Processing, Peking University(北京大学多媒体信息处理国家重点实验室) School of Computer Science, Peking University(北京大学计算机科学学院) Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院) Beijing Academy of Artificial Intelligence(北京智源人工智能研究院) School of Computing, National University of Singapore(新加坡国立大学计算机学院) YiXin-AILab, YIXIN(YiXin-AILab,YIXIN)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.AI

AI总结 提出HOLMES基准,基于高阶逻辑评估LLM在规则、谓词和约束上的推理能力,发现当前模型平均准确率仅50.64%,揭示高阶符号推理是关键瓶颈。

详情

展开后加载摘要…

URL PDF HTML 收藏