arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-04-01 至 2026-04-01 共收录 6 信号源:cs.CL, cs.AI, cs.LG

1. 逻辑推理 6 篇

2603.29997 2026-04-01 cs.CL cs.AI 88%

Enhancing Structural Mapping with LLM-derived Abstractions for Analogical Reasoning in Narratives

通过LLM衍生抽象增强结构映射以提升叙事中的类比推理

Mohammadhossein Khojasteh, Yifan Jiang, Stefano De Giorgis, Frank van Harmelen, Filip Ilievski

机构 * Vrije Universiteit Amsterdam(阿姆斯特丹自由大学) University of Southern California(南加州大学)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 本文提出YARN框架,利用LLM分解叙事并抽象单元,提升叙事类比推理能力,实验表明抽象显著提升性能,揭示了抽象层级、隐含因果关系和类比模式分类的挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21035 2026-04-01 cs.AI cs.CL 81%

CLAUSE: Agentic Neuro-Symbolic Knowledge Graph Reasoning via Dynamic Learnable Context Engineering

CLAUSE: 通过动态可学习上下文工程实现基于代理的神经符号知识图谱推理

Yang Zhao, Chengxiao Dai, Wei Zhuo, Yue Xiu, Dusit Niyato

机构 * Independent Researcher(独立研究员) School of Computer Science, The University of Sydney, Australia(悉尼大学计算机科学学院) College of Computing & Data Science, Nanyang Technological University, Singapore(南洋理工大学计算与数据科学学院)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 CLAUSE通过动态可学习上下文工程实现神经符号知识图谱推理,优化多跳问答的准确率、延迟和成本,减少子图增长和端到端延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00017 2026-04-01 cs.LO cs.AI cs.AR 80%

Generative Logic: A New Computer Architecture for Deterministic Reasoning and Knowledge Generation

生成逻辑:一种新的计算机架构用于确定性推理和知识生成

Nikolai Sergeev

机构 * Generative Logic UG

专题命中 逻辑推理 :reasoning(title);verifier(abstract,comments);分类 cs.AI

AI总结 生成逻辑(GL)是一种确定性架构,通过用户提供的公理定义生成可配置的演绎邻域,通过逻辑块和统一的哈希推理引擎实现证明生成与知识生成,实验验证其在数论中的应用及CAS系统潜力。

Comments v4: Incubator, Compressor, Verifier (34,320 checks, 0 failures). New CAS chapter. Pipeline diagram. Branching outlook, FTA campaign, CAS roadmap, LLM demo in Future Work. Updated MPL listing and runtimes. 24pp, 8 figs. Zenodo DOI: 10.5281/zenodo.17206386

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29109 2026-04-01 cs.SE cs.AI 79%

SemLoc: Structured Grounding of Free-Form LLM Reasoning for Fault Localization

SemLoc:基于结构化语义绑定的自由形式LLM推理故障定位

Zhaorui Yang, Haichao Zhu, Qian Zhang, Rajiv Gupta, Ashish Kundu

机构 * UC Riverside(加州大学河滨分校) Cisco Research(思科研究院) Independent Researcher(独立研究员)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.AI

AI总结 SemLoc通过结构化语义绑定将自由形式LLM推理转化为封闭中间表示,结合语义违反光谱提升故障定位精度,实现7.6%的代码检查效率提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28952 2026-04-01 cs.RO 50%

World2Rules: A Neuro-Symbolic Framework for Learning World-Governing Safety Rules for Aviation

World2Rules: 一种用于航空领域学习世界治理安全规则的神经符号框架

Haichuan Wang, Jay Patrikar, Sebastian Scherer

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 逻辑推理 :reasoning(abstract)

AI总结 World2Rules通过结合神经网络和符号方法,从航空多模态数据中学习安全规则,提升规则的准确性和可解释性,实验显示其在F1得分上优于纯神经和单步神经符号基线。

Comments 19 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28068 2026-04-01 cs.CV 50%

AIBench: Evaluating Visual-Logical Consistency in Academic Illustration Generation

AIBench:评估学术示意图生成中的视觉-逻辑一致性

Zhaohe Liao, Kaixun Jiang, Zhihang Liu, Yujie Wei, Junqiu Yu, Quanhao Li, Hong-Tao Yu, Pandeng Li, Yuzheng Wang, Zhen Xing, Shiwei Zhang, Chen-Wei Xie, Yun Zheng, Xihui Liu

机构 * Tongyi Lab, Alibaba Group(阿里巴巴集团通义实验室) SJTU(上海交通大学) FDU(复旦大学) USTC(中国科学技术大学) SEU(东南大学) HKU(香港大学)

专题命中 逻辑推理 :reasoning(abstract)

AI总结 本文提出AIBench,首个通过VQA评估学术示意图逻辑正确性及VLM评估美观性的基准,通过四层问题验证生成示意图与论文的一致性,发现模型在该任务上的性能差异显著,且逻辑与美观难以同时优化。

详情

展开后加载摘要…

URL PDF HTML 收藏