arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 3005 信号源:cs.CL, cs.AI, cs.LG

1. 逻辑推理 3005 篇

2404.14812 2025-05-27 cs.CL 85%

Enhancing Chain of Thought Prompting in Large Language Models via Reasoning Patterns

Yufeng Zhang, Xuepeng Wang, Lingxiang Wu, Jinqiao Wang

专题命中 逻辑推理 :reasoning(title,abstract);CoT(abstract);logical reasoning(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.05515 2025-05-12 q-bio.NC cs.LG 85%

Nature's Insight: A Novel Framework and Comprehensive Analysis of Agentic Reasoning Through the Lens of Neuroscience

Zinan Liu, Haoran Li, Jingyi Lu, Gaoyuan Ma, Xu Hong, Giovanni Iacca, Arvind Kumar, Shaojun Tang, Lin Wang

机构 * School of EEE, Nanyang Technological University (NTU)(南洋理工大学电子工程系) School of Cyber Science and Technology, University of Science and Technology of China(中国科学技术大学网络科学与技术学院) School of Integrated Circuits and Electronics, Beijing Institute of Technology(北京理工大学集成电路与电子学院) School of Social Sciences, Nanyang Technological University(南洋理工大学社会科学学院) Department of Information Engineering and Computer Science, University of Trento(特伦托大学信息工程与计算机科学系) Division of Computational Science and Technology, KTH Royal Institute of Technology(皇家理工学院计算科学与技术系) Bioscience and Biomedical Engineering, Hong Kong University of Science & Technology(香港科技大学生物科学与生物医学工程系)

专题命中 逻辑推理 :reasoning(title,abstract);chain-of-thought(abstract);logical reasoning(abstract);分类 cs.LG

Comments 39 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.00776 2025-05-05 cs.CL 85%

Reasoning Capabilities and Invariability of Large Language Models

Alessandro Raganato, Rafael Peñaloza, Marco Viviani, Gabriella Pasi

机构 * Department of Informatics, Systems, and Communication (DISCo) University of Milano-Bicocca(信息学、系统与通信系(DISCo)米兰-比科卡大学)

专题命中 逻辑推理 :reasoning(title,abstract);chain-of-thought(abstract);logical reasoning(abstract);分类 cs.CL

Comments Accepted for publication in the Proceedings of the 23rd IEEE/WIC International Conference on Web Intelligence and Intelligent Agent Technology (WI-IAT 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.17539 2025-02-10 cs.CL 85%

Logic-of-Thought: Injecting Logic into Contexts for Full Reasoning in Large Language Models

Tongxuan Liu, Wenjiang Xu, Weizhe Huang, Yuting Zeng, Jiaxing Wang, Xingyu Wang, Hailong Yang, Jing Li

专题命中 逻辑推理 :reasoning(title,abstract);chain-of-thought(abstract);logical reasoning(abstract);分类 cs.CL

Comments 18 pages, Accepted to NAACL2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.12997 2024-10-18 cs.CL 85%

"Let's Argue Both Sides": Argument Generation Can Force Small Models to Utilize Previously Inaccessible Reasoning Capabilities

Kaveh Eskandari Miandoab, Vasanth Sarathy

专题命中 逻辑推理 :reasoning(title,abstract);chain-of-thought(abstract);logical reasoning(abstract);分类 cs.CL

Comments Accepted to Workshop on Customizable NLP: Progress and Challenges in Customizing NLP for a Domain, Application, Group, or Individual at EMNLP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.06853 2024-10-10 cs.CL 85%

Large Language Models Can Learn Temporal Reasoning

Siheng Xiong, Ali Payani, Ramana Kompella, Faramarz Fekri

专题命中 逻辑推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL

Comments ACL24 (main)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.04463 2024-10-08 cs.CL 85%

Wrong-of-Thought: An Integrated Reasoning Framework with Multi-Perspective Verification and Wrong Information

Yongheng Zhang, Qiguang Chen, Jingxuan Zhou, Peng Wang, Jiasheng Si, Jin Wang, Wenpeng Lu, Libo Qin

专题命中 逻辑推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL

Comments Accepted by EMNLP 2024 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.17820 2024-06-04 cs.CL 85%

Meta-Reasoning: Semantics-Symbol Deconstruction for Large Language Models

Yiming Wang, Zhuosheng Zhang, Pei Zhang, Baosong Yang, Rui Wang

专题命中 逻辑推理 :reasoning(title,abstract);chain-of-thought(abstract);logical reasoning(abstract);分类 cs.CL

Comments Accepted by ACL 2024 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.01293 2023-06-05 cs.CL 85%

ThinkSum: Probabilistic reasoning over sets using large language models

Batu Ozturkler, Nikolay Malkin, Zhen Wang, Nebojsa Jojic

专题命中 逻辑推理 :reasoning(title,abstract);chain-of-thought(abstract);logical reasoning(abstract);分类 cs.CL

Comments ACL 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13065 2026-04-16 cs.CL cs.AI cs.LO 85%

Correct Chains, Wrong Answers: Dissociating Reasoning from Output in LLM Logic

正确推理,错误答案:分离LLM中的推理与输出

Abinav Rao, Sujan Rachuri, Nikhil Vemuri

专题命中 逻辑推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.CL、cs.AI;logical reasoning(comments)

AI总结 本文提出新型操作测试基准,区分操作逻辑与名称,揭示LLM在深度推理中存在策略与内容两类失败模式,验证名称不决定推理能力。

Comments 9 pages, 4 figures. ICLR 2026 Workshop on Logical Reasoning of LLMs

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.06438 2026-02-18 cs.CL cs.AI 85%

Don't Let It Hallucinate: Premise Verification via Retrieval-Augmented Logical Reasoning

不要让它幻觉:通过检索增强的逻辑推理进行前提验证

Yuehan Qin, Shawn Li, Yi Nian, Xinyan Velocity Yu, Yue Zhao, Xuezhe Ma

机构 * University of Southern California(南加州大学)

专题命中 逻辑推理 :reasoning(title);logical reasoning(title);分类 cs.CL、cs.AI

AI总结 本文提出一种基于检索增强的逻辑推理方法,用于在生成前验证用户查询中的前提,从而减少幻觉并提高事实准确性。

Comments TMLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.17304 2025-06-12 cs.CL cs.AI 85%

Meaningless is better: hashing bias-inducing words in LLM prompts improves performance in logical reasoning and statistical learning

Milena Chadimová, Eduard Jurášek, Tomáš Kliegr

专题命中 逻辑推理 :reasoning(title);logical reasoning(title);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2105.14167 2021-06-11 cs.CL cs.AI 85%

NeuralLog: Natural Language Inference with Joint Neural and Logical Reasoning

Zeming Chen, Qiyue Gao, Lawrence S. Moss

专题命中 逻辑推理 :reasoning(title);logical reasoning(title);分类 cs.CL、cs.AI

Comments 8 pages, 4 figures, The 10th Joint Conference on Lexical and Computational Semantics (*SEM2021) @ ACL2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27783 2026-07-31 cs.CL cs.AI cs.LG 新提交 85%

Reasoning Consensus: Structural Ensembling of LLM Reasoning via Weighted DAG Aggregation

推理共识:通过加权有向无环图聚合实现大语言模型推理的结构集成

Amruta Parulekar, Jinu Lee, Dilek Hakkani-Tür, Hari Sundaram

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 逻辑推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 该研究提出通过加权DAG聚合集成LLM推理结构的框架,在六个基准上优于多数投票基线,可提供可检查的共识推理图,还能分析不同推理视角。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11538 2026-03-05 cs.CV 85%

Reinforcing Video Reasoning Segmentation to Think Before It Segments

强化视频推理分割以在分割前思考

Sitong Gong, Lu Zhang, Yunzhi Zhuge, Xu Jia, Pingping Zhang, Huchuan Lu

专题命中 逻辑推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract)

AI总结 Veason-R1通过组相对策略优化和链式思维初始化,提升视频推理分割的结构化推理能力,实现更准确的时空定位和鲁棒性。

Comments 12 pages

Journal ref CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08213 2026-02-10 cs.LG cs.AI cs.CL q-bio.QM 85%

DrugR: Optimizing Molecular Drugs through LLM-based Explicit Reasoning

DrugR: 通过基于大语言模型的显式推理优化分子药物

Haoran Liu, Zheni Zeng, Yukun Yan, Yuxuan Chen, Yunduo Xiao

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 DrugR通过基于大语言模型的显式推理方法,优化分子药物的ADMET性质,提升药理效果并提供可解释的优化依据。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06687 2026-02-09 cs.CR 85%

Evaluating and Enhancing the Vulnerability Reasoning Capabilities of Large Language Models

评估和增强大型语言模型的漏洞推理能力

Li Lu, Yanjie Zhao, Hongzhou Rao, Kechi Zhang, Haoyu Wang

专题命中 逻辑推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract)

AI总结 DAGVul通过建模漏洞推理为有向无环图生成任务,提升大型语言模型在漏洞检测中的推理能力,实验显示其推理F1分数平均提高18.9%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06040 2026-02-06 cs.CV 85%

SwimBird: Eliciting Switchable Reasoning Mode in Hybrid Autoregressive MLLMs

SwimBird: 在混合自回归大语言模型中实现可切换的推理模式

Jintao Tong, Shilin Yan, Hongwei Xue, Xiaojun Tang, Kunyu Shi, Guannan Zhang, Ruixuan Li, Yixiong Zou

机构 * Huazhong University of Science and Technology(华中科技大学) Accio Team, Alibaba Group(阿里集团Accio团队)

专题命中 逻辑推理 :reasoning(title,abstract);CoT(abstract);logical reasoning(abstract)

AI总结 SwimBird通过动态切换三种推理模式,提升多模态大语言模型在视觉密集任务中的性能,同时保持文本推理能力。

Comments Project Page: https://accio-lab.github.io/SwimBird

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13704 2025-12-23 cs.CV 85%

TiViBench: Benchmarking Think-in-Video Reasoning for Video Generative Models

TiViBench: 用于视频生成模型的视频推理基准测试

Harold Haodong Chen, Disen Lan, Wen-Jie Shu, Qingyang Liu, Zihan Wang, Sirui Chen, Wenkai Cheng, Kanghao Chen, Hongfei Zhang, Zixin Zhang, Rongjin Guo, Yu Cheng, Ying-Cong Chen

专题命中 逻辑推理 :reasoning(title,abstract);planning(abstract);logical reasoning(abstract)

AI总结 TiViBench提出用于评估视频生成模型的推理能力,结合VideoTPO提升推理性能,揭示商业与开源模型在推理潜力上的差异。

Comments Project: https://haroldchen19.github.io/TiViBench-Page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.04646 2025-11-07 cs.AI cs.CL cs.LG cs.MA 85%

DR. WELL: Dynamic Reasoning and Learning with Symbolic World Model for Embodied LLM-Based Multi-Agent Collaboration

Narjes Nourzad, Hanqing Yang, Shiyu Chen, Carlee Joe-Wong

机构 * University of Southern California(南加州大学) Carnegie Mellon University(卡内基梅隆大学)

专题命中 逻辑推理 :reasoning(title,abstract);planning(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24811 2025-10-30 cs.CL cs.AI cs.LG 85%

ProofSketch: Efficient Verified Reasoning for Large Language Models

Disha Sheshanarayana, Tanishka Magar

机构 * Manipal University Jaipur(马普尔大学斋普尔)

专题命中 逻辑推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted at NeurIPS 2025, ER Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12434 2025-10-15 cs.CV 85%

VideoRFT: Incentivizing Video Reasoning Capability in MLLMs via Reinforced Fine-Tuning

Qi Wang, Yanrui Yu, Ye Yuan, Rui Mao, Tianfei Zhou

机构 * Beijing Institute of Technology(北京理工大学) Shenzhen University(深圳大学)

专题命中 逻辑推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract)

Comments Accepted by NeurIPS 2025. Code: https://github.com/QiWang98/VideoRFT

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04289 2025-08-21 cs.AI cs.CL cs.LG 85%

Method-Based Reasoning for Large Language Models: Extraction, Reuse, and Continuous Improvement

Hong Su

机构 * School of Computer Science, Chengdu University of Information Technology(计算机科学学院,成都信息科技学院)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.23918 2025-07-04 cs.CV 85%

Thinking with Images for Multimodal Reasoning: Foundations, Methods, and Future Frontiers

Zhaochen Su, Peng Xia, Hangyu Guo, Zhenhua Liu, Yan Ma, Xiaoye Qu, Jiaqi Liu, Yanshu Li, Kaide Zeng, Zhengyuan Yang, Linjie Li, Yu Cheng, Heng Ji, Junxian He, Yi R. Fung

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) UNC-Chapel Hill(北卡罗来纳大学教堂山分校) Microsoft(微软) The Chinese University of Hong Kong(香港中文大学) UIUC(伊利诺伊大学厄巴纳-香槟分校)

专题命中 逻辑推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract)

Comments Preprint in progress. We maintain a real-time GitHub repository tracking progress at: https://github.com/zhaochen0110/Awesome_Think_With_Images

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.08974 2025-07-02 cs.CV 85%

Topo2Seq: Enhanced Topology Reasoning via Topology Sequence Learning

Yiming Yang, Yueru Luo, Bingkun He, Erlong Li, Zhipeng Cao, Chao Zheng, Shuqi Mei, Zhen Li

专题命中 逻辑推理 :reasoning(title,abstract);planning(abstract);logical reasoning(abstract)

Journal ref Proceedings of the AAAI Conference on Artificial Intelligence (AAAI-2025), 39(9), 9318-9326

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15806 2025-06-04 cs.CR cs.AI cs.CL cs.LG 85%

A Mousetrap: Fooling Large Reasoning Models for Jailbreak with Chain of Iterative Chaos

Yang Yao, Xuan Tong, Ruofan Wang, Yixu Wang, Lujundong Li, Liang Liu, Yan Teng, Yingchun Wang

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) The University of Hong Kong(香港大学) Fudan University(复旦大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22320 2025-05-29 cs.NI 85%

Chain-of-Thought for Large Language Model-empowered Wireless Communications

Xudong Wang, Jian Zhu, Ruichen Zhang, Lei Feng, Dusit Niyato, Jiacheng Wang, Hongyang Du, Shiwen Mao, Zhu Han

专题命中 逻辑推理 :chain-of-thought(title,abstract);reasoning(abstract);CoT(abstract)

Comments 7 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.02611 2025-03-04 cs.AI cs.CL cs.LG 85%

FCoReBench: Can Large Language Models Solve Challenging First-Order Combinatorial Reasoning Problems?

Chinmay Mittal, Krishna Kartik, Mausam, Parag Singla

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.07099 2024-12-31 cs.CL cs.AI cs.GT cs.LG 85%

Nash CoT: Multi-Path Inference with Preference Equilibrium

Ziqi Zhang, Cunxiang Wang, Xiong Xiao, Yue Zhang, Donglin Wang

专题命中 逻辑推理 :CoT(title,abstract);reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

Journal ref EMNLP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.14324 2024-09-24 cs.CL cs.AI cs.LG 85%

Unveiling Narrative Reasoning Limits of Large Language Models with Trope in Movie Synopses

Hung-Ting Su, Ya-Ching Hsu, Xudong Lin, Xiang-Qian Shi, Yulei Niu, Han-Yuan Hsu, Hung-yi Lee, Winston H. Hsu

专题命中 逻辑推理 :reasoning(title,abstract);CoT(abstract);分类 cs.CL、cs.AI、cs.LG

Comments EMNLP 2024 Findings. The first two authors contributed equally. Code: https://github.com/Shelley1214/Trope

详情

展开后加载摘要…

URL PDF HTML 收藏