arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-05-26 至 2026-05-26 共收录 19 信号源:cs.CL, cs.AI, cs.LG

1. 逻辑推理 19 篇

2603.05143 2026-05-26 cs.CL cs.LG 88%

Feature Resemblance: Towards a Theoretical Understanding of Analogical Reasoning in Transformers

特征相似性:迈向对Transformer中类比推理的理论理解

Ruichen Xu, Wenjing Yan, Ying-Jun Angela Zhang

机构 * Department of Information Engineering, The Chinese University of Hong Kong, Hong Kong(香港中文大学信息工程系)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.LG

AI总结 本文通过最小化Transformer抽象模型,从理论上证明联合训练和特定课程顺序能使实体在表示空间中对齐,从而通过特征相似性实现属性转移,即类比推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24305 2026-05-26 cs.LG cs.AI 87%

ChaosBench-Logic v2: Evaluating LLM Logical Reasoning over Dynamical Systems at Scale

ChaosBench-Logic v2: 大规模评估大语言模型在动力系统上的逻辑推理能力

Noel Thomas

机构 * Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title);分类 cs.AI、cs.LG

AI总结 针对二元推理基准的准确性掩盖了关键缺陷,本文提出包含40,886个问题、覆盖165个动力系统的ChaosBench-Logic v2基准和CARE评估协议,揭示模型在状态转换推理、FOL演绎等任务上的表现差异和系统性反相关。

Comments 14 pages, 8 figures. Published at the ICLR 2026 Workshop on LLM Reasoning

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25618 2026-05-26 cs.SC 87%

Symbolic-Neural Soft-Logic Reasoning: Towards Robust and Verifiable Thinking Chains via Cooperative Evolution

符号-神经软逻辑推理:通过协同进化实现鲁棒且可验证的思维链

Rui Wang, Zeming Wei, Yihao Zhang, Xiaokun Luan

专题命中 逻辑推理 :reasoning(title,abstract);CoT(abstract,abstract_cn);chain-of-thought(abstract)

AI总结 提出符号-神经软逻辑推理(SSR)框架,通过结合LLM与符号推理并放松严格逻辑确定性,提升推理鲁棒性和可验证性,实验表明优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11027 2026-05-26 cs.LG cs.AI cs.PL 81%

From Reasoning to Code: GRPO Optimization for Underrepresented Languages

从推理到代码:针对代表性不足语言的GRPO优化

Federico Pennino, Bianca Raimondi, Massimo Rondelli, Andrea Gurioli, Maurizio Gabbrielli

机构 * Qwen2.5-Coder

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.AI、cs.LG

AI总结 提出结合Qwen2.5-Coder小模型与GRPO的强化学习方法,利用执行反馈和奖励机制提升Prolog、Lisp等低资源语言的代码生成准确性与推理质量。

Comments Accepted ICLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25964 2026-05-26 cs.AI 79%

LECTOR: Joint Optimization of Scientific Reasoning Graphs and Introduction Generation

LECTOR: 科学推理图与引言生成的联合优化

Jiabei Xiao, Yizhou Wang, Chen Tang, Pengze Li, Wanli Ouyang, Shixiang Tang

机构 * The Chinese University of Hong Kong(香港中文大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Fudan University(复旦大学)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.AI

AI总结 提出LECTOR框架,通过逻辑-表达协同强化学习联合优化科学推理图的结构保真度和引言生成质量,在Nature Communications数据集上实现显著提升。

Comments 25 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25566 2026-05-26 cs.AI 79%

Uncertainty Reasoning with Large Language Models for Explainable Disease Diagnosis

基于大语言模型的不确定性推理用于可解释疾病诊断

Xiaoyang Fan, Yufan Cai, Zhe Hou, Jin Song Dong

机构 * National University of Singapore(新加坡国立大学) Griffith University(格里菲斯大学)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.AI

AI总结 提出一种神经符号推理框架,将大语言模型与模糊逻辑和声明式规则结合,实现可解释且形式可验证的医学诊断。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25511 2026-05-26 cs.CL 79%

CRPO: Character-centric Group Relative Policy Optimization for Role-aware Reasoning in Role-playing Agents

CRPO:以角色为中心的群体相对策略优化用于角色扮演代理中的角色感知推理

Yihong Tang, Kehai Chen, Liang Yue, Benyou Wang, Min Zhang

机构 * Institute of Computing and Intelligence(计算与智能研究院) Harbin Institute of Technology(哈尔滨工业大学) Shenzhen Loop Area Institute (SLAI)(深圳Loop区研究院) The Chinese University of Hong Kong(香港中文大学)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.CL

AI总结 提出CRPO框架,通过解耦任务逻辑与风格奖励、动态调整优化约束和利用通用响应作为负基线,解决强化学习在角色扮演中角色保真度下降和风格崩溃问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18363 2026-05-26 cs.CL cs.AI cs.LG 75%

PowerFlow: Unlocking the Dual Nature of LLMs via Principled Distribution Matching

PowerFlow: 通过原则性分布匹配释放LLMs的双重特性

Ruishuo Chen, Yu Chen, Zhuoran Li, Longbo Huang

机构 * Institute for Interdisciplinary Information Sciences, Tsinghua University, Beijing, China(清华大学交叉信息研究院)

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 提出PowerFlow框架,将无监督微调重构成分布匹配问题,利用GFlowNet和长度感知轨迹平衡目标,通过调整α-幂分布方向性激发LLMs的逻辑推理或创造性。

Comments Camera-ready version accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14479 2026-05-26 cs.AI cs.CL 73%

A Neuro-Symbolic Approach for Reliable Proof Generation with LLMs: A Case Study in Euclidean Geometry

一种用于LLM可靠证明生成的神经符号方法:以欧几里得几何为例

Oren Sultan, Eitan Stern, Dafna Shahaf

机构 * The Hebrew University of Jerusalem(特拉维夫大学)

专题命中 逻辑推理 :reasoning(abstract);verifier(abstract);分类 cs.CL、cs.AI

AI总结 提出一种结合LLM生成能力与结构化组件的神经符号方法,通过类比问题检索和形式验证器反馈,显著提升欧几里得几何证明的准确性。

Comments long paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25062 2026-05-26 cs.NE cs.AI 70%

Cultivating Machine Intelligence: The OMEGA Shift from Top-Down Optimization to Autopoietic Cognitive Ecologies

培养机器智能:从自上而下优化到自创生认知生态的OMEGA转变

Ata G. Zare

机构 * Nyenrode Business University(奈恩罗德商学院)

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract);分类 cs.AI

AI总结 针对当前深度学习优化范式导致的幻觉、谄媚、奖励破解和对齐脆弱等结构性缺陷,提出RECLAIM框架,通过计算生态学而非严格优化来培养智能,并引入OMEGA转变概念。

Comments Extended preprint. A shorter version of this work is currently under peer review

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24873 2026-05-26 cs.CL cs.AI cs.LG 67%

Towards a Universal Causal Reasoner

迈向通用因果推理器

Qirun Dai, Xiao Liu, Jiawei Zhang, Dylan Zhang, Hao Peng, Chenhao Tan

机构 * The University of Chicago(芝加哥大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 提出UniCo数据生成框架,覆盖Pearl因果阶梯的18种查询类型,将符号示例转化为代码和自然语言,通过监督微调显著提升LLM的因果推理能力和推理忠实度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.01284 2026-05-26 cs.CV cs.AI cs.CL cs.IR 62%

Chain of Evidence: Pixel-Level Visual Attribution for Iterative Retrieval-Augmented Generation

证据链:面向迭代检索增强生成的像素级视觉归因

Peiyang Liu, Ziqiang Cui, Xi Wang, Di Liang, Wei Ye

机构 * National Engineering Research Center for Software Engineering, Peking University(软件工程国家级工程研究中心,北京大学) City University of Hong Kong(香港城市大学) Peking University(北京大学) Tencent Technology(腾讯科技)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 提出Chain of Evidence (CoE)框架,利用视觉语言模型直接对检索到的文档截图进行推理,输出精确边界框以可视化完整推理链,解决迭代检索增强生成中的粗粒度归因和视觉语义丢失问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05450 2026-05-26 cs.AI cs.CL 62%

Distributed Partial Information Puzzles: Examining Common Ground Construction Under Epistemic Asymmetry

分布式部分信息谜题:在认知不对称下检验共同基础的构建

Yifan Zhu, Mariah Bradford, Kenneth Lai, Timothy Obiso, Videep Venkatesha, James Pustejovsky, Nikhil Krishnaswamy

机构 * Brandeis University(布兰迪斯大学) Colorado State University(科罗拉多州立大学)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 提出分布式部分信息谜题(DPIP)任务,收集多模态数据集,并评估大语言模型与动态认知逻辑方法在追踪信念状态和共同基础构建上的表现。

Comments 10 pages, 4 figures

Journal ref Proceedings of COLING-LREC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23728 2026-05-26 cs.CV cs.AI 57%

ESIA: An Energy-Based Spatiotemporal Interaction-Aware Framework for Pedestrian Intention Prediction

ESIA:基于能量的时空交互感知框架用于行人意图预测

Yanping Wu, Meiting Dang, Lin Wu, Edmond S. L. Ho, Zhenghua Chen, Chongfeng Wei

机构 * James Watt School of Engineering, University of Glasgow(格拉斯哥大学詹姆斯·瓦特工程学院)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI

AI总结 提出ESIA框架,利用条件随机场和能量函数建模时空交互,通过结构一致性约束和模拟退火算法实现行人意图预测,在标准基准上达到最先进性能并提升可解释性。

Comments 13 pages, 6 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04279 2026-05-26 cs.CL 57%

ECG-R1: Protocol-Guided and Modality-Agnostic MLLM for Reliable ECG Interpretation

ECG-R1: 协议引导且模态无关的可靠心电图解读多模态大语言模型

Jiarui Jin, Haoyu Wang, Xingliang Wu, Xiaocheng Fang, Xiang Lan, Zihan Wang, Deyun Zhang, Bo Liu, Yingying Zhang, Xian Wu, Hongyan Li, Shenda Hong

机构 * School of Intelligence Science and Technology, Peking University(北京大学智能科学与技术学院) National Institute of Health Data Science, Peking University(北京大学健康数据科学国家研究院) State Key Laboratory of General Artificial Intelligence, Peking University(北京大学通用人工智能国家重点实验室) Tianjin Institute of Cardiology, the Second Hospital of Tianjin Medical University(天津医科大学第二医院心内科) National University of Singapore(新加坡国立大学) Jarvis Lab, Tencent(腾讯 Jarvis实验室) HeartVoice Medical Technology(HeartVoice医疗科技)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.CL

AI总结 提出ECG-R1,通过协议引导数据生成、模态解耦架构和强化学习,实现可靠的心电图解读。

Comments Accepted to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25129 2026-05-26 cs.LG 57%

Blocked Gibbs meets Diffusion Transformers: Unsupervised Learning for Constraint Optimization

分块吉布斯采样遇上扩散Transformer:约束优化的无监督学习

Yudong W. Xu, Wenhao Li, Xiaoyu Wang, Scott Sanner, Elias B. Khalil

机构 * University of Toronto(多伦多大学) Vector Institute(向量研究所)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.LG

AI总结 提出分块吉布斯扩散Transformer(BloGDiT),通过分块高斯去噪替代标准联合高斯去噪,解决扩散模型在约束优化中变量子集大规模编辑的需求,在数独、图着色、最大独立集和MaxCut任务上匹配或超越现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26021 2026-05-26 quant-ph 50%

Toward General Quantum Control with Physics-Informed Large Language Models

面向通用量子控制的物理信息大语言模型

Yusheng Zhao, Han Wang, Xin Liu, Xinjie Song, Jixi He, Lingwei Song, Yuanhe Ji, Ken Deng, Runqing Zhang, Zhiguo Huang, Ling Qian, Jize Han, Di Luo

专题命中 逻辑推理 :reasoning(abstract)

AI总结 提出VF-QCTRL框架,结合物理信息大语言模型与符号推理及优化,实现通用量子控制协议的高保真度设计,并通过QCTRL-BENCH基准测试验证其通用性、准确性、效率和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24619 2026-05-26 cs.SE 50%

Synthesizing Inductive Invariants for Distributed Protocols via IC3 and Large Language Models

通过IC3和大语言模型综合分布式协议的归纳不变量

Weining Cao, Guangyuan Wu, Yuan Yao, Hengfeng Wei, Taolue Chen, Xiaoxing Ma

专题命中 逻辑推理 :reasoning(abstract)

AI总结 提出IC3Syn框架,结合符号IC3控制器和大语言模型,自动综合分布式协议的归纳不变量,无需逻辑限制或人工模板,在29个协议上验证了有效性。

Comments 15 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.23985 2026-05-26 cs.DB cs.IR 50%

Federated Semantic Knowledge Graphs for Laboratory Workflows: A Structured Expert Elicitation Methodology Demonstrated Through Bioanalytical Workflow Twins

面向实验室工作流的联邦语义知识图谱:通过生物分析工作流孪生展示的结构化专家启发方法

Luis F. Schachner, Vinith Thamizhazhagan, Sara Tanenbaum, John C. Tran, Pamela P. F. Chan, Mandy Kwong, Andy Chang, Maureen Beresini, Margaret Porter Scott

专题命中 逻辑推理 :reasoning(abstract)

AI总结 提出一种可重复的结构化专家启发方法和联邦语义知识图谱架构,用于捕获和查询实验室工作流中的隐性知识,并通过Genentech的部署案例展示了跨子图查询能力,特别是识别自动化掩盖的静默故障。

Comments 48 pages, 4 figures, 3 appendices. Submitted to ISWC 2026 In-Use Track

详情

展开后加载摘要…

URL PDF HTML 收藏