arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 3016 信号源:cs.CL, cs.AI, cs.LG

1. 逻辑推理 3016 篇

2503.07885 2026-03-05 cs.RO cs.AI 77%

Safety Guardrails for LLM-Enabled Robots

LLM赋能机器人中的安全护栏

Zachary Ravichandran, Alexander Robey, Vijay Kumar, George J. Pappas, Hamed Hassani

机构 * University of Pennsylvania(宾夕法尼亚大学) Carnegie Mellon University(卡内基梅隆大学)

专题命中 逻辑推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.AI

AI总结 RoboGuard通过两阶段护栏架构,利用根信任LLM和链式推理生成上下文安全规范,有效降低LLM赋能机器人在对抗攻击下的不安全计划执行率,提升系统安全性与可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17789 2026-01-27 cs.AI 77%

Neuro-Symbolic Verification on Instruction Following of LLMs

神经符号验证在大语言模型指令遵循上的应用

Yiming Su, Kunzhao Xu, Yanjie Gao, Fan Yang, Cheng Li, Mao Yang, Tianyin Xu

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) University of Science and Technology of China(中国科学技术大学) Microsoft Research(微软研究院)

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract);verifier(abstract);分类 cs.AI

AI总结 本文提出NSVIF框架,通过神经符号方法验证大语言模型是否遵循指令,实验表明其在指令遵循验证中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.18839 2026-01-12 cs.CL 77%

Detect, Explain, Escalate: Sustainable Dialogue Breakdown Management for LLM Agents

检测、解释、升级:面向LLM代理的可持续对话破裂管理

Abdellah Ghassel, Xianzhi Li, Xiaodan Zhu

机构 * Department of Electrical and Computer Engineering and Ingenuity Labs Research Institute, Queen’s University(电气与计算机工程系和Ingenuity Labs研究研究所,皇后大学)

专题命中 逻辑推理 :reasoning(abstract);chain-of-thought(abstract);logical reasoning(abstract);分类 cs.CL

AI总结 本文提出了一种可持续对话破裂管理框架,通过高效检测器和升级架构,在LLM代理中实现资源高效的对话破裂管理,提升对话AI的可靠性和成本效益。

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.19405 2025-11-11 cs.AI 77%

Logic Distillation: Learning from Code Function by Function for Decision-making Tasks

Dong Chen, Shilin Zhang, Fei Gao, Yueting Zhuang, Siliang Tang, Qidong Liu, Mingliang Xu

机构 * The School of Computer and Artificial Intelligence of Zhengzhou University(郑州大学计算机与人工智能学院) Engineering Research Center of Intelligent Swarm Systems, Ministry of Education(教育部智能群体系统工程研究中心) National Supercomputing Center In Zhengzhou(郑州国家超级计算中心) Zhejiang University(浙江大学)

专题命中 逻辑推理 :reasoning(abstract);planning(abstract);logical reasoning(abstract);分类 cs.AI

Comments 9 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17377 2025-11-11 cs.CL 77%

Robustness of Neurosymbolic Reasoners on First-Order Logic Problems

Hannah Bansal, Kemal Kurniawan, Lea Frermann

机构 * RMIT University(皇家墨尔本理工大学) The University of Melbourne(墨尔本大学)

专题命中 逻辑推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL

Comments Accepted to ALA Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08970 2025-10-06 cs.AI 77%

Gala: Global LLM Agents for Text-to-Model Translation

Junyang Cai, Serdar Kadioglu, Bistra Dilkina

机构 * Department of Computer Science, University of Southern California(南加州大学计算机科学系) AI Center of Excellence, Fidelity Investments(富达投资人工智能卓越中心) Department of Computer Science, Brown University(布朗大学计算机科学系)

专题命中 逻辑推理 :reasoning(abstract);chain-of-thought(abstract);logical reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11127 2025-09-16 cs.CL 77%

Joint Effects of Argumentation Theory, Audio Modality and Data Enrichment on LLM-Based Fallacy Classification

Hongxu Zhou, Hylke Westerdijk, Khondoker Ittehadul Islam

机构 * University of Groningen(格罗宁根大学)

专题命中 逻辑推理 :reasoning(abstract);chain-of-thought(abstract);logical reasoning(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20960 2025-07-29 cs.AI 77%

On the Limits of Hierarchically Embedded Logic in Classical Neural Networks

Bill Cochran

机构 * Bill Cochran

专题命中 逻辑推理 :reasoning(abstract);planning(abstract);logical reasoning(abstract);分类 cs.AI

Comments 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.06178 2025-07-22 cs.LG 77%

A Large Language Model-Enhanced Q-learning for Capacitated Vehicle Routing Problem with Time Windows

Linjiang Cao, Maonan Wang, Xi Xiong

专题命中 逻辑推理 :chain-of-thought(abstract);CoT(abstract);self-correction(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.11477 2025-04-17 cs.CV cs.AI 77%

SDIGLM: Leveraging Large Language Models and Multi-Modal Chain of Thought for Structural Damage Identification

Yunkai Zhang, Shiyin Wei, Yong Huang, Yawu Su, Shanshan Lu, Hui Li

专题命中 逻辑推理 :reasoning(abstract);CoT(abstract);logical reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.02760 2025-03-05 cs.CL 77%

From Metaphor to Mechanism: How LLMs Decode Traditional Chinese Medicine Symbolic Language for Modern Clinical Relevance

Jiacheng Tang, Nankai Wu, Fan Gao, Chengxiao Dai, Mengyao Zhao, Xinjie Zhao

专题命中 逻辑推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.09589 2025-02-18 cs.CL cs.LO 77%

Logical forms complement probability in understanding language model (and human) performance

Yixuan Wang, Freda Shi

专题命中 逻辑推理 :reasoning(abstract);planning(abstract);logical reasoning(abstract);分类 cs.CL

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.10869 2024-11-19 cs.CL cs.CE cs.CY cs.HC 77%

Large Language Models (LLMs) as Traffic Control Systems at Urban Intersections: A New Paradigm

Sari Masri, Huthaifa I. Ashqar, Mohammed Elhenawy

专题命中 逻辑推理 :reasoning(abstract);chain-of-thought(abstract);logical reasoning(abstract);分类 cs.CL

Comments The data and code that support the findings of this study are openly available in Zenodo at https://doi.org/10.5281/zenodo.14171745, reference number 14171745

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.10730 2024-11-19 cs.CL cs.CR 77%

Comparison of Multilingual and Bilingual Models for Satirical News Detection of Arabic and English

Omar W. Abdalla, Aditya Joshi, Rahat Masood, Salil S. Kanhere

专题命中 逻辑推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL

Comments ALTA 2024 (Selected for publication)

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.07387 2024-11-08 cs.CL 77%

Assessing Logical Puzzle Solving in Large Language Models: Insights from a Minesweeper Case Study

Yinghao Li, Haorui Wang, Chao Zhang

专题命中 逻辑推理 :reasoning(abstract);planning(abstract);logical reasoning(abstract);分类 cs.CL

Comments 23 pages, 5 figures, 4 tables, in NAACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.21779 2024-10-30 cs.CL 77%

Leveraging LLMs for Hypothetical Deduction in Logical Inference: A Neuro-Symbolic Approach

Qingchuan Li, Jiatong Li, Tongxuan Liu, Yuting Zeng, Mingyue Cheng, Weizhe Huang, Qi Liu

专题命中 逻辑推理 :reasoning(abstract);CoT(abstract);logical reasoning(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.16461 2024-09-26 cs.CL 77%

Strategies for Improving NL-to-FOL Translation with LLMs: Data Generation, Incremental Fine-Tuning, and Verification

Ramya Keerthy Thatikonda, Jiuzhou Han, Wray Buntine, Ehsan Shareghi

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract);verifier(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.00745 2024-02-02 cs.CL 77%

Enhancing Ethical Explanations of Large Language Models through Iterative Symbolic Refinement

Xin Quan, Marco Valentino, Louise A. Dennis, André Freitas

专题命中 逻辑推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL

Comments Camera-ready for EACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.07850 2023-12-14 cs.AI 77%

Large Language Model Enhanced Multi-Agent Systems for 6G Communications

Feibo Jiang, Li Dong, Yubo Peng, Kezhi Wang, Kun Yang, Cunhua Pan, Dusit Niyato, Octavia A. Dobre

专题命中 逻辑推理 :reasoning(abstract);planning(abstract);logical reasoning(abstract);分类 cs.AI

Comments Submitted for possible journal publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.02144 2023-09-06 cs.CL cs.AI cs.LG 76%

Making Large Language Models Better Reasoners with Alignment

Peiyi Wang, Lei Li, Liang Chen, Feifan Song, Binghuai Lin, Yunbo Cao, Tianyu Liu, Zhifang Sui

专题命中 逻辑推理 :reasoning(abstract,comments);CoT(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Large Language Models; Reasoning; Alignment

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07395 2026-07-29 cs.CV cs.AI cs.LG 版本更新 76%

When Prompts Ignore Structure: Graph-Based Attribute Reasoning for Calibrated VLMs

当提示忽略结构时:基于图的属性推理用于校准视觉语言模型

Tanay Sodha, Aditya Sharma, Ramya Hebbalaguppe, Vinti Agarwal, Pranav Murthy Yeluripaty

机构 * Birla Institute of Technology and Science, Pilani(贝拉科技与科学学院皮拉尼分校) TCS Research(塔塔咨询服务公司研究院)

专题命中 逻辑推理 :reasoning(title);分类 cs.AI、cs.LG

AI总结 研究视觉语言模型测试时自适应中可靠置信度估计问题,提出ARGTCA方法,将(类,属性)对表示为符号属性图节点,用对比目标训练图注意力网络,引入两种属性选择策略,实验证明该方法能有效降低校准误差。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02023 2026-07-16 cs.CL cs.AI 版本更新 76%

Not All Needles Are Found: How Fact Distribution and Don't Make It Up Prompts Shape Retrieval, Reasoning, and Hallucination in Long-Context LLMs

并非所有线索都能被发现:事实分布和“不要编造”提示如何影响长上下文语言模型中的检索、推理和幻觉

Amirali Ebrahimzadeh, Seyyed M. Salili

机构 * Department of Electrical Engineering & Computer Science University of Michigan(电气工程与计算机科学系 密歇根大学)

专题命中 逻辑推理 :reasoning(title);分类 cs.CL、cs.AI

AI总结 研究大语言模型中事实分布和反幻觉提示对检索、推理及幻觉的影响,通过扩展基准评估多个模型,识别出分布崩溃和安全代价两种失败模式,发现许多失败源于无效上下文利用,强调特定模型稳健性和上下文管理的重要性。

Comments 16 pages, 8 figures, 2 tables. Accepted at the FAGEN Workshop @ ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08960 2026-07-13 cs.LG cs.AI 新提交 76%

Eluna: An Agentic LLM System for Automating Warehouse Operations with Reasoning and Task Execution

Eluna:一个用于通过推理和任务执行实现仓库运营自动化的智能语言模型系统

Ning Liu, Kalle Kujanpää, Zhaoxuan Zhu, P Aditya Sreekar, Kaiwen Liu, Chuanneng Sun, Jorge Marchena Menendez, Matthew Bales, Tianyu Yang, Shahnawaz Alam, Rose Yu, Baoyuan Liu, Kristina Klinkner, Shervin Malmasi

机构 * Amazon.com, Inc. Fulfillment Technologies and Robotics(亚马逊公司履约技术与机器人部门)

专题命中 逻辑推理 :reasoning(title);分类 cs.AI、cs.LG

AI总结 研究针对仓库运营中SOP执行问题,提出Eluna智能体系统,它是图形引导多智能体框架,采用非对称情节蒸馏方法,在基准测试和生产应用中,微调模型表现出色,匹配或超教师模型,击败基线,在票务处理应用达94%专家一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04360 2026-06-04 cs.CL cs.LG 76%

Deliberate Evolution: Agentic Reasoning for Sample-Efficient Symbolic Regression with LLMs

Deliberate Evolution: 基于智能体推理的样本高效符号回归与LLM

Xinyu Pang, Zhanke Zhou, Xuan Li, Fangrui Lv, Shanshan Wei, Sen Cui, Bo Han, Changshui Zhang

机构 * TMLR Group, Department of Computer Science, Hong Kong Baptist University(香港 Baptist 大学计算机科学系 TMLR 组) Beijing National Research Center for Information Science(北京信息科学国家研究中心) Technology (BNRist), Department of Automation, Tsinghua University, Beijing, P.R. China(技术(BNRist),自动化系,清华大学,北京,中华人民共和国) Lenovo Research(联想研究)

专题命中 逻辑推理 :reasoning(title);分类 cs.CL、cs.LG

AI总结 提出Deliberate Evolution框架,通过解耦符号生成与搜索控制,利用自适应算子、分析工具和反思记忆,在仅用40%样本预算下超越现有LLM符号回归方法。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12520 2026-05-14 cs.CL cs.AI 76%

BoostTaxo: Zero-Shot Taxonomy Induction via Boosting-Style Agentic Reasoning and Constraint-Aware Calibration

BoostTaxo:通过提升式代理推理和约束感知校准进行零样本分类诱导

Yancheng Ling, Zhenlin Qin, Leizhen Wang, Zhenliang Ma

机构 * KTH Royal Institute of Technology(皇家理工学院) Monash University(莫纳什大学)

专题命中 逻辑推理 :reasoning(title);分类 cs.CL、cs.AI

AI总结 BoostTaxo通过提升式代理推理和约束感知校准方法,提升零样本分类诱导的泛化能力、结构可靠性及效率,实验证明其在WordNet、DBLP和SemEval-Sci数据集上性能优异。

Comments 13 pages,7 figtures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10816 2026-02-12 cs.CL cs.AI 76%

Beyond Confidence: The Rhythms of Reasoning in Generative Models

超越置信度:生成模型推理的节奏

Deyuan Liu, Zecheng Wang, Zhanyue Qin, Zhiying Tu, Dianhui Chu, Dianbo Sui

机构 * Harbin Institute of Technology(哈尔滨工业大学)

专题命中 逻辑推理 :reasoning(title);分类 cs.CL、cs.AI

AI总结 本文提出δ_TC B度量标准,用于评估生成模型在预测稳定性方面的鲁棒性,揭示了传统度量在上下文学习中的不足,并为提升模型稳定性提供新方法。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.15527 2024-11-18 cs.AI cs.LG 76%

Interpretable Concept-Based Memory Reasoning

David Debot, Pietro Barbiero, Francesco Giannini, Gabriele Ciravegna, Michelangelo Diligenti, Giuseppe Marra

专题命中 逻辑推理 :reasoning(title);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.13490 2024-09-26 cs.CL cs.AI 76%

Combining Constraint Programming Reasoning with Large Language Model Predictions

Florian Régin, Elisabetta De Maria, Alexandre Bonlarron

专题命中 逻辑推理 :reasoning(title);分类 cs.CL、cs.AI

Comments To appear at The 30th International Conference on Principles and Practice of Constraint Programming (CP 2024)

Journal ref In 30th International Conference on Principles and Practice of Constraint Programming (CP 2024). Leibniz International Proceedings in Informatics (LIPIcs), Volume 307, pp. 25:1-25:18, Schloss Dagstuhl - Leibniz-Zentrum fur Informatik (2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.17140 2023-10-27 cs.CL cs.AI 76%

Symbolic Planning and Code Generation for Grounded Dialogue

Justin T. Chiu, Wenting Zhao, Derek Chen, Saujas Vaduguru, Alexander M. Rush, Daniel Fried

专题命中 逻辑推理 :planning(title);分类 cs.CL、cs.AI

Comments Accepted to EMNLP 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.00422 2023-09-04 cs.AI cs.CY cs.LG cs.SC 76%

Declarative Reasoning on Explanations Using Constraint Logic Programming

Laura State, Salvatore Ruggieri, Franco Turini

专题命中 逻辑推理 :reasoning(title);分类 cs.AI、cs.LG

Comments European Conference on Logics in Artificial Intelligence (JELIA 2023)

详情

展开后加载摘要…

URL PDF HTML 收藏