arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-03-17 至 2026-03-17 共收录 13 信号源:cs.CL, cs.AI, cs.LG

1. 逻辑推理 13 篇

2603.15317 2026-03-17 cs.CL 79%

PYTHEN: A Flexible Framework for Legal Reasoning in Python

PYTHEN:一种用于法律推理的灵活框架

Ha-Thanh Nguyen, Ken Satoh

机构 * Center for Juris-Informatics, ROIS-DS, Tokyo, Japan(法律信息中心,ROIS-DS,东京,日本) Research and Development Center for Large Language Models, NII, Tokyo, Japan(大语言模型研究开发中心,NII,东京,日本)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.CL

AI总结 本文介绍PYTHEN,一种基于Python的新型法律推理框架,通过灵活的语法支持法律规则、条件和例外的表示,结合Python内置函数提升灵活性,并探讨其在自动形式化和下一代法律AI系统中的应用。

Comments Accepted at JURISIN 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15280 2026-03-17 cs.AI 79%

Advancing Multimodal Agent Reasoning with Long-Term Neuro-Symbolic Memory

通过长期神经符号记忆推进多模态代理推理

Rongjie Jiang, Jianwei Wang, Gengda Zhao, Chengyang Luo, Kai Wang, Wenjie Zhang

机构 * University of New South Wales(新南威尔士大学) Zhejiang University(浙江大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.AI

AI总结 本文提出NS-Mem框架,结合神经记忆与符号结构,提升多模态代理的推理能力,实验证明其在推理准确率上优于纯神经记忆系统。

Comments 11 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06117 2026-03-17 cs.LG 79%

The Active Discoverer Framework: Towards Autonomous Physics Reasoning through Neuro-Symbolic LaTeX Synthesis

主动发现框架:通过神经符号LaTeX合成实现自主物理推理

Hyunjun Jeon

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.LG

AI总结 本文提出主动发现框架,通过神经符号LaTeX合成实现自主物理推理,解决神经网络在大规模计算中的精度问题,并验证其在物理常数推导中的有效性。

Comments V4 Coming S00N :)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13266 2026-03-17 cs.AI 79%

Multi-hop Reasoning and Retrieval in Embedding Space: Leveraging Large Language Models with Knowledge

嵌入空间中的多跳推理与检索:利用大型语言模型与知识

Lihui Liu

机构 * Wayne State University(韦恩州立大学)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.AI

AI总结 本文提出EMBRAG框架,通过生成基于知识图谱的逻辑规则并在嵌入空间中推理,提升知识图谱问答任务的鲁棒性和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13612 2026-03-17 cs.AI 74%

LLM Routing as Reasoning: A MaxSAT View

LLM路由作为推理:一种MaxSAT视角

Son Nguyen, Xinyuan Liu, Ransalu Senanayake

机构 * Arizona State University(亚利桑那州立大学)

专题命中 逻辑推理 :reasoning(title);分类 cs.AI

AI总结 本文提出基于约束的LLM路由方法,将其建模为加权MaxSAT问题,通过自然语言反馈生成硬约束和软约束,实验证明语言反馈能产生近可行推荐集,揭示了语言条件下的结构化约束优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12932 2026-03-17 cs.CL 70%

DS$^2$-Instruct: Domain-Specific Data Synthesis for Large Language Models Instruction Tuning

DS$^2$-Instruct: 领域特定数据合成用于大语言模型指令微调

Ruiyao Xu, Noelle I. Samia, Han Liu

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract);分类 cs.CL

AI总结 DS$^2$-Instruct通过零样本方法生成领域特定指令数据集,结合任务关键词和布卢姆分类法不同认知层次,提升模型在数学、金融等七个领域性能。

Comments EACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14935 2026-03-17 cs.CV 67%

Video-CoE: Reinforcing Video Event Prediction via Chain of Events

Video-CoE:通过事件链强化视频事件预测

Qile Su, Jing Tang, Rui Chen, Lei Sun, Xiangxiang Chu

机构 * AMAP, Alibaba Group(阿里妈妈,阿里巴巴集团)

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract)

AI总结 本文提出Video-CoE方法,通过构建时间事件链提升视频事件预测的准确性,实验表明其优于现有主流大语言模型。

Comments 21 pages, 18 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14221 2026-03-17 cs.RO cs.AI cs.LG 62%

A Real-Time Neuro-Symbolic Ethical Governor for Safe Decision Control in Autonomous Robotic Manipulation

面向自主机器人操作的安全决策控制实时神经符号伦理控制器

Aueaphum Aueawatthanaphisut, Kuepon Aueawatthanaphisut

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出一种实时神经符号伦理控制器,通过整合伦理推理与风险评估机制,提升自主机器人操作中的安全决策能力,实验验证了其在不同人类接近度和操作风险下的有效性。

Comments 6 pages, 6 figures, 5 equations

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13258 2026-03-17 cs.LG cs.AI cs.SE 62%

Your Code Agent Can Grow Alongside You with Structured Memory

你的代码代理可以与你一同成长,借助结构化记忆

Yi-Xuan Deng, Xiaoqin Liu, Yi Zhang, Guo-Wei Yang, Shuojin Yang

机构 * Tsinghua University(清华大学)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出MemCoder框架,通过结构化记忆和实时反馈实现人类与AI的持续共进化,提升代码代理在复杂软件工程任务中的性能。

Comments Code Agent

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15087 2026-03-17 cs.SE 50%

Beyond Monolithic Models: Symbolic Seams for Composable Neuro-Symbolic Architectures

超越单体模型:符号缝合用于可组合的神经符号架构

Nicolas Schuler, Vincenzo Scotti, Raffaela Mirandola

专题命中 逻辑推理 :reasoning(abstract)

AI总结 本文提出符号缝合概念,旨在通过可组合的神经符号架构提升AI系统的可扩展性和透明性,结合数据驱动的适应性与显式约束的可验证性。

Comments Submitted to New and Emerging Ideas (NEMI) track at ICSA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05065 2026-03-17 cs.CR 50%

Personalizing Agent Privacy Decisions via Logical Entailment

通过逻辑蕴含个性化代理隐私决策

James Flemings, Ren Yi, Octavian Suciu, Kassem Fawaz, Murali Annavaram, Marco Gruteser

专题命中 逻辑推理 :reasoning(abstract)

AI总结 本文提出ARIEL框架,结合LLM与规则逻辑,实现结构化个性化隐私决策,实验显示其在适当判断的F1误差率上降低40.6%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13723 2026-03-17 cs.SE 50%

Do AI Agents Really Improve Code Readability?

AI代理真的能提高代码可读性吗?

Kyogo Horikawa, Kosei Horikawa, Yutaro Kashiwa, Hidetake Uwano, Hajimu Iida

专题命中 逻辑推理 :planning(abstract)

AI总结 研究探讨AI代理重构对代码可读性的影响,通过分析403个提交发现,AI主要改进逻辑复杂度和文档,但导致传统质量指标下降。

Comments 5 pages

Journal ref 23rd International Conference on Mining Software Repositories (MSR '26) , 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13333 2026-03-17 cs.RO 50%

STL-SVPIO: Signal Temporal Logic guided Stein Variational Path Integral Optimization

STL-SVPIO:信号时序逻辑引导的Stein变分路径积分优化

Hongrui Zheng, Zirui Zang, Ahmad Amine, Cristian Ioan Vasile, Rahul Mangharam

机构 * Department of Electrical and Systems Engineering, University of Pennsylvania(宾夕法尼亚大学电气与系统工程系) Mechanical Engineering and Mechanics Department, Lehigh University(莱特大学机械工程与力学系)

专题命中 逻辑推理 :planning(abstract)

AI总结 本文提出STL-SVPIO方法,通过将信号时序逻辑转化为可微的奖励塑造机制,解决复杂STL约束下的长周期连续控制轨迹合成问题,提升鲁棒性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏