arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 3005 信号源:cs.CL, cs.AI, cs.LG

1. 逻辑推理 3005 篇

2406.00284 2024-07-12 cs.CL 88%

A Closer Look at Logical Reasoning with LLMs: The Choice of Tool Matters

Long Hei Matthew Lam, Ramya Keerthy Thatikonda, Ehsan Shareghi

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL

Comments Code and data are publicly available at: https://github.com/Mattylam/Logic_Symbolic_Solvers_Experiment

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.05557 2024-07-09 cs.AI 88%

$R^2$-Guard: Robust Reasoning Enabled LLM Guardrail via Knowledge-Enhanced Logical Reasoning

Mintong Kang, Bo Li

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.11035 2024-06-18 cs.CL 88%

Scaling Synthetic Logical Reasoning Datasets with Context-Sensitive Declarative Grammars

Damien Sileo

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.05597 2024-05-06 cs.CL 88%

Can language models learn analogical reasoning? Investigating training objectives and comparisons to human performance

Molly R. Petersen, Lonneke van der Plas

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.10723 2023-09-20 cs.CL cs.DB cs.LO 88%

Fine-tuning Large Enterprise Language Models via Ontological Reasoning

Teodoro Baldazzi, Luigi Bellomarini, Stefano Ceri, Andrea Colombo, Andrea Gentili, Emanuel Sallinger

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL

Comments Accepted at RuleML 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.13585 2023-05-24 cs.CL 88%

Query Structure Modeling for Inductive Logical Reasoning Over Knowledge Graphs

Siyuan Wang, Zhongyu Wei, Meng Han, Zhihao Fan, Haijun Shan, Qi Zhang, Xuanjing Huang

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL

Comments 11 pages, 2 figures, 8 tables, accepted as a long paper to ACL 203

详情

展开后加载摘要…

URL PDF HTML 收藏
2205.00731 2022-07-11 cs.CL 88%

Logiformer: A Two-Branch Graph Transformer Network for Interpretable Logical Reasoning

Fangzhi Xu, Jun Liu, Qika Lin, Yudai Pan, Lingling Zhang

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL

Comments Accepted by SIGIR 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2105.04620 2021-05-12 cs.AI 88%

A Description Logic for Analogical Reasoning

Steven Schockaert, Yazmín Ibáñez-García, Víctor Gutiérrez-Basulto

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.AI

Comments Accepted for IJCAI 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.23965 2026-07-03 cs.AI cs.LG cs.SE 版本更新 88%

LGMT: Logic-Grounded Metamorphic Testing for Evaluating the Reasoning Reliability of LLMs

LGMT:基于逻辑的蜕变测试用于评估LLMs的推理可靠性

Zenghui Zhou, Man Li, Xiaoke Fang, Xinyi Zhou, Weibin Lin, Zheng Zheng

机构 * School of Automation Science and Electrical Engineering, Beihang University(自动化科学与电气工程学院,北京航空航天大学)

专题命中 逻辑推理 :reasoning(title,abstract);CoT(abstract,abstract_cn);logical reasoning(abstract);分类 cs.AI、cs.LG

AI总结 提出LGMT框架,利用一阶逻辑推导蜕变关系,通过一致性检查评估LLM推理的鲁棒性,揭示传统评估忽略的隐藏缺陷。

Comments Zheng Zheng is the corresponding author

Journal ref Knowledge-Based Systems, Volume 348, 2026, 116324, ISSN 0950-7051

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23938 2026-06-24 cs.AI cs.CL 新提交 88%

Neuro-Symbolic Drive: Rule-Grounded Faithful Reasoning for Driving VLAs

神经符号驱动:基于规则忠实推理的驾驶VLA

Xiangbo Gao, Xiukun Huang, Boyu Lu, Junge Zhang, Mengjie Mao, Jiachen Li, Wei Xiong, Zhengzhong Tu

机构 * Texas A&M University(德克萨斯农工大学) Carnegie Mellon University(卡内基梅隆大学) University of Maryland(马里兰大学) University of California, Riverside(加利福尼亚大学河滨分校) University of Pittsburgh(匹兹堡大学)

专题命中 逻辑推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);planning(abstract)

AI总结 提出神经符号驱动框架,利用规则规划器的决策轨迹监督驾驶VLA,实现推理与运动生成的因果耦合,显著降低轨迹误差和碰撞率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16845 2026-06-24 cs.CL cs.AI 新提交 88%

Robust Dual-Signal Fusion: Hybrid Neuro-Symbolic Gating with Compressed Chain-of-Thought Refinement for Irony Detection in Social Media Texts

鲁棒双信号融合:混合神经符号门控与压缩链式思维精炼用于社交媒体文本讽刺检测

Ankit Bhattacharjee, Krityapriya Bhaumik

机构 * Indian Institute of Technology Kharagpur(印度理工学院克勒格布尔分校)

专题命中 逻辑推理 :chain-of-thought(title,abstract);CoT(abstract,abstract_cn);reasoning(abstract);分类 cs.CL、cs.AI

AI总结 提出RDS融合框架,结合神经符号架构与压缩链式思维推理,在TweetEval和iSarcasm数据集上达到与微调BERTweet相当的性能,并显著优于监督方法。

Comments 11 pages total, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27251 2026-05-28 cs.CL cs.AI 88%

Compliance versus Sensibility: On the Reasoning Controllability in Large Language Models

服从与感知:大型语言模型中的推理可控性研究

Xingwei Tan, Marco Valentino, Mahmud Elahi Akhter, Yuxiang Zhou, Maria Liakata, Nikolaos Aletras

机构 * School of Computer Science, University of Sheffield(谢菲尔德大学计算机科学学院) School of EECS, Queen Mary University of London(伦敦女王学院电子工程与计算机科学学院) The Alan Turing Institute(艾伦·图灵研究所)

专题命中 逻辑推理 :reasoning(title,abstract);CoT(abstract,abstract_cn);chain-of-thought(abstract);分类 cs.CL、cs.AI

AI总结 通过推理冲突视角,系统研究大型语言模型在诱导逻辑模式与任务预期模式冲突时,是否优先服从指令还是遵循感知合理性,并探索内部检测与激活级干预方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15797 2026-03-19 cs.LG cs.AI 88%

OMNIFLOW: A Physics-Grounded Multimodal Agent for Generalized Scientific Reasoning

OMNIFLOW:一种基于物理的多模态代理用于通用科学推理

Hao Wu, Yongheng Zhang, Yuan Gao, Fan Xu, Fan Zhang, Ruobing Xie, Ruijian Gou, Yuxuan Liang, Xiaomeng Huang, Xian Wu

机构 * Tsinghua University(清华大学) Tencent(腾讯) Shenzhen Loop Area Institute(深圳河套学院) Ocean University of China(海洋大学) HKUST (Guangzhou)(香港科技大学(广州))

专题命中 逻辑推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);logical reasoning(abstract)

AI总结 OMNIFLOW通过引入语义-符号对齐机制和物理引导的推理流程,实现了多模态模型在物理定律下的科学推理,显著提升了零样本泛化和少样本适应能力,提供透明且物理一致的推理报告。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12133 2026-03-13 cs.AI cs.CL 88%

TopoBench: Benchmarking LLMs on Hard Topological Reasoning

TopoBench:在复杂拓扑推理上对LLM进行基准测试

Mayug Maniparambil, Nils Hoehing, Janak Kapuriya, Arjun Karuvally, Ellen Rushe, Anthony Ventresque, Noel O'Connor, Fergal Reid

机构 * Intercom Research(Intercom研究院) University College Dublin(都柏林大学) University of Galway(Galway大学) Salk Institute(Salk研究所) Dublin City University(都柏林城市大学) Trinity College Dublin(都柏林三一学院)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,comments);分类 cs.CL、cs.AI

AI总结 TopoBench通过测试LLM在复杂拓扑推理任务上的表现,揭示了模型在提取空间约束方面的瓶颈,并提出缓解策略。

Comments Accepted, Workshop on Logical Reasoning of Large Language Models at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12526 2026-02-16 cs.LG cs.CL 88%

Constraint-Rectified Training for Efficient Chain-of-Thought

约束校正训练用于高效的推理链

Qinhang Wu, Sen Lin, Ming Zhang, Yingbin Liang, Ness B. Shroff

机构 * The Ohio State University(俄亥俄州立大学) University of Houston(休斯顿大学) Google(谷歌)

专题命中 逻辑推理 :chain-of-thought(title,abstract);reasoning(abstract);CoT(abstract);self-correction(abstract)

AI总结 CRT通过约束校正训练提升推理效率,减少冗余并保持准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22202 2025-10-14 cs.CL cs.AI 88%

Latent Reasoning via Sentence Embedding Prediction

Hyeonbin Hwang, Byeongguk Jeon, Seungone Kim, Jiyeon Kim, Hoyeon Chang, Sohee Yang, Seungpil Won, Dohaeng Lee, Youbin Ahn, Minjoon Seo

机构 * KAIST(韩国科学技术院) Carnegie Mellon University(卡内基梅隆大学) University College London(伦敦大学学院) LG AI Research(LG人工智能研究)

专题命中 逻辑推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);planning(abstract)

Comments Previously titled "Let's Predict Sentence by Sentence"; Presented @ COLM RAM 2 Workshop (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.07316 2025-05-22 cs.CL cs.AI 88%

CodeI/O: Condensing Reasoning Patterns via Code Input-Output Prediction

Junlong Li, Daya Guo, Dejian Yang, Runxin Xu, Yu Wu, Junxian He

专题命中 逻辑推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);planning(abstract)

Comments ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27828 2026-06-29 cs.CV 新提交 88%

Video-MME-Logical: A Controlled Diagnostic Benchmark for Video Temporal-Logical Reasoning

Video-MME-Logical: 面向视频时序逻辑推理的受控诊断基准

Hohin Kwan, Hongyu Li, Ray Zhang, Manyuan Zhang, Xianghao Kong, Anyi Rao, Jiahao Xie, Si Liu

机构 * HKUST(香港科技大学) Colab, Beihang University(北京航空航天大学合作实验室) CUHK(香港中文大学)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract)

AI总结 为隔离评估多模态大模型在视频中的时序逻辑推理能力,提出包含五种时序逻辑操作和25个细粒度任务类别的受控基准,通过控制时间跨度和推理复杂度进行难度可控评估,并支持中间状态诊断。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27590 2026-06-02 cs.CV cs.MM 88%

ForestHG-Trace: Traceable Long-Horizon Ecological Reasoning over Large-Scale Forest Scenes

ForestHG-Trace: 大规模森林场景下的可追踪长程生态推理

Zihang Cheng, Duanchu Wang, Cheng Li, Jing Huang, Huanzhao Fu, Di Wang

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract)

AI总结 提出ForestHG-Trace框架,通过生态超图表示和LLM引导的确定性工具链,实现森林场景中可追踪的多步生态推理,并构建ForestTraceQA基准,显著提升长程生态问答的准确性和执行忠实度。

Comments It has theoretical flaws and experimental errors

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.19045 2026-05-20 cs.CY 88%

Beyond Nutrition Labels: How Analogical Reasoning Shapes Synthetic Media Disclosure Design

超越营养标签:类比推理如何塑造合成媒体披露设计

Claire R. Leibowicz

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract)

AI总结 本研究探讨了在复杂的社会技术约束下,AI政策制定者和实践者如何设计合成媒体披露,识别了过程透明和危害减少等关键披露目标,并揭示了规范性与中立性、主动与精确性之间的核心矛盾,强调了类比推理在管理但不解决这些矛盾中的作用。

Comments 18 pages, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07626 2025-08-12 cs.CV cs.RO 88%

AR-VRM: Imitating Human Motions for Visual Robot Manipulation with Analogical Reasoning

Dejie Yang, Zijing Zhao, Yang Liu

机构 * Wangxuan Institute of Computer Technology, Peking University(北京大学计算机技术研究院) State Key Laboratory of General Artificial Intelligence, Peking University(北京大学通用人工智能国家重点实验室)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract)

Comments Accepted by ICCV2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02170 2025-07-04 cs.MA 88%

Synergizing Logical Reasoning, Knowledge Management and Collaboration in Multi-Agent LLM System

Adam Kostka, Jarosław A. Chudziak

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract)

Journal ref Proceedings of the 38th Pacific Asia Conference on Language, Information and Computation (PACLIC 2024), Tokyo, Japan, pages 203-212, December 2024. Tokyo University of Foreign Studies

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.04105 2025-06-23 cs.LG cs.AI cs.CL 88%

A Implies B: Circuit Analysis in LLMs for Propositional Logical Reasoning

Guan Zhe Hong, Nishanth Dikkala, Enming Luo, Cyrus Rashtchian, Xin Wang, Rina Panigrahy

机构 * Purdue University(普渡大学) Google Research(谷歌研究)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.19524 2025-04-29 cs.CV 88%

LR-IAD:Mask-Free Industrial Anomaly Detection with Logical Reasoning

Peijian Zeng, Feiyan Pang, Zhanbo Wang, Aimin Yang

机构 * School of Computer Science and Technology, Guangdong University of Technology(广东技术大学计算机科学与技术学院) School of Computer Science and Intelligence Education, Lingnan Normal University(岭南师范学院计算机科学与智能教育学院)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title);CoT(abstract)

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24305 2026-05-26 cs.LG cs.AI 87%

ChaosBench-Logic v2: Evaluating LLM Logical Reasoning over Dynamical Systems at Scale

ChaosBench-Logic v2: 大规模评估大语言模型在动力系统上的逻辑推理能力

Noel Thomas

机构 * Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title);分类 cs.AI、cs.LG

AI总结 针对二元推理基准的准确性掩盖了关键缺陷,本文提出包含40,886个问题、覆盖165个动力系统的ChaosBench-Logic v2基准和CARE评估协议,揭示模型在状态转换推理、FOL演绎等任务上的表现差异和系统性反相关。

Comments 14 pages, 8 figures. Published at the ICLR 2026 Workshop on LLM Reasoning

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29354 2026-06-30 cs.AI cs.NE 87%

When LLMs Develop Languages: Symbolic Communication for Efficient Multi-Agent Reasoning

当大语言模型发展语言:用于高效多智能体推理的符号通信

Zhengqi Pei, Qingming Huang, Shuhui Wang

专题命中 逻辑推理 :reasoning(title,abstract);CoT(abstract,abstract_cn);chain-of-thought(abstract);分类 cs.AI

AI总结 提出CLSR框架,让多个LLM智能体自主发明和演化紧凑符号语言,通过路由器自适应选择以优化准确率与token成本的权衡,在保持准确率的同时将推理token数减少3-6倍。

Comments ICML2026 Regular paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22642 2026-06-23 cs.LG 版本更新 87%

Compress the Easy, Explore the Hard: Difficulty-Aware Entropy Regularization for Efficient LLM Reasoning

压缩简单问题,探索困难问题:面向高效LLM推理的难度感知熵正则化

Qin-Wen Luo, Sheng Ren, Xiang Chen, Rui Liu, Jun Fang, Naiqiang Tan, Sheng-Jun Huang

机构 * Nanjing University of Aeronautics and Astronautics(南京航空航天大学) College of Computer Science and Technology(计算机科学与技术学院) Didichuxing Co. Ltd(滴滴出行有限公司)

专题命中 逻辑推理 :reasoning(title,abstract);CoT(abstract,abstract_cn);chain-of-thought(abstract);分类 cs.LG

AI总结 提出CEEH方法,通过难度感知的熵正则化,在强化学习中对简单问题压缩推理长度,对困难问题保持探索空间,从而在减少响应长度的同时维持推理准确性。

Comments Accepted to KDD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18873 2026-04-22 cs.AI 87%

From Natural Language to Executable Narsese: A Neuro-Symbolic Benchmark and Pipeline for Reasoning with NARS

从自然语言到可执行的Narsese:一种神经符号基准和管道用于基于NARS的推理

Mina Gabriel, Pei Wang

机构 * Temple University(特拉华大学)

专题命中 逻辑推理 :reasoning(title,summary_cn);分类 cs.AI

AI总结 本文提出神经符号框架,将自然语言推理问题转换为可执行的形式化表示,结合FOL和Narsese,并引入NARS-Reasoning-v0.1基准,支持符号生成与执行验证,展示可监督适应的潜力。

Comments 14 pages. Submitted to AGI-26

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13738 2026-02-17 cs.AI 87%

OneLatent: Single-Token Compression for Visual Latent Reasoning

OneLatent:视觉潜在推理中的单令牌压缩

Bo Lv, Yasheng Sun, Junjie Wang, Haoxiang Shi

机构 * Tsinghua University(清华大学) Institute of Science Tokyo(东京科学研究所) Waseda University(早稻田大学)

专题命中 逻辑推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);logical reasoning(abstract)

AI总结 OneLatent通过将中间推理压缩为单个潜在令牌,提升了视觉推理效率,同时保持较高的准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.18382 2025-09-24 cs.AI 87%

Evaluating the Safety and Skill Reasoning of Large Reasoning Models Under Compute Constraints

Adarsha Balaji, Le Chen, Rajeev Thakur, Franck Cappello, Sandeep Madireddy

机构 * Argonne National Laboratory(阿贡国家实验室) Mathematics and Computer Science Division(数学与计算机科学 division) Data Science and Learning Division(数据科学与学习 division)

专题命中 逻辑推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);test-time compute(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏