arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-03-11 至 2026-03-11 共收录 7 信号源:cs.CL, cs.AI, cs.LG

1. 逻辑推理 7 篇

2603.09200 2026-03-11 cs.AI cs.CL cs.CY cs.LG 89%

The Reasoning Trap -- Logical Reasoning as a Mechanistic Pathway to Situational Awareness

推理陷阱——逻辑推理作为情境意识的机制路径

Subramanyam Sahoo, Aman Chadha, Vinija Jain, Divya Chaudhary

机构 * MARS 4.0 Fellowship, Cambridge AI Safety Hub(CAISH), University of Cambridge(MARS 4.0 Fellow,剑桥人工智能安全中心(CAISH),剑桥大学) AWS Generative AI Innovation Center, Amazon Web Services, USA(亚马逊生成AI创新中心,亚马逊网络服务,美国) Google, USA(谷歌,美国) Stanford University(斯坦福大学) Northeastern University, Seattle, WA, USA(东北大学,西雅图,华盛顿州,美国)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出RAISE框架,揭示逻辑推理能力提升与情境意识升级的机制路径,并提出安全原则与测试方法以应对潜在风险。

Comments Accepted at ICLR 2026 Workshop on Logical Reasoning of Large Language Models. 21 Pages. Position Paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09268 2026-03-11 cs.AI 83%

Logos: An evolvable reasoning engine for rational molecular design

Logos:一种可进化推理引擎用于理性分子设计

Haibin Wen, Zhe Zhao, Fanfu Wang, Tianyi Xu, Hao Zhang, Chao Yang, Ye Wei

机构 * City University of Hong Kong(香港城市大学) Lanzhou University(兰州大学) Riltide Medicines(Riltide医药公司) Shanghai Jiao Tong University(上海交通大学)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(abstract);分类 cs.AI

AI总结 Logos是一种集成多步逻辑推理与严格化学一致性的分子推理模型,通过分阶段训练和化学规则优化,在多个基准数据集上实现了结构准确性和化学有效性上的高性能,同时参数量仅为通用语言模型的几分之一。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13756 2026-03-11 cs.CV cs.AI cs.LG 81%

RECODE: Reasoning Through Code Generation for Visual Question Answering

RECODE: 通过代码生成进行视觉问答的推理

Junhong Shen, Mu Cai, Bo Hu, Ameet Talwalkar, David A Ross, Cordelia Schmid, Alireza Fathi

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.AI、cs.LG

AI总结 RECODE通过代码生成实现视觉问答的可验证推理,优于传统方法。

Comments The authors are withdrawing this manuscript temporarily to conduct additional checks of the experimental setup and implementation. We plan to post an updated version after completing these checks

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09246 2026-03-11 cs.CR 78%

Reasoning-Oriented Programming: Chaining Semantic Gadgets to Jailbreak Large Vision Language Models

面向推理的编程:通过链式语义工具来突破大型视觉语言模型

Quanchen Zou, Moyang Chen, Zonghao Ying, Wenzhuo Xu, Yisong Xiao, Deyue Zhang, Dongdong Yang, Zhao Liu, Xiangzheng Zhang

专题命中 逻辑推理 :reasoning(title,abstract)

AI总结 本文提出面向推理的编程方法,通过链式语义工具突破大型视觉语言模型的安全对齐。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09756 2026-03-11 cs.DB 67%

Epistemic Closure: Autonomous Mechanism Completion for Physically Consistent Simulation

认知闭合:用于物理一致模拟的自主机制完成

Yue Wua, Tianhao Su, Rui Hu, Mingchuan Zhao, Shunbo Hu, Deng Pan, Jizhong Huang

专题命中 逻辑推理 :reasoning(abstract);chain-of-thought(abstract)

AI总结 本文提出神经符号生成代理,通过自主验证和完成物理机制,解决科学模拟中的物理幻觉问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09192 2026-03-11 cs.AI 57%

Explainable Innovation Engine: Dual-Tree Agent-RAG with Methods-as-Nodes and Verifiable Write-Back

可解释的创新引擎:双树代理-RAG与方法作为节点和可验证的写回

Renwei Meng

机构 * Anhui University(安徽大学)

专题命中 逻辑推理 :verifier(abstract);分类 cs.AI

AI总结 本研究提出了一种双树代理-RAG框架,通过方法作为节点和可验证的写回机制,提升代理系统在可控、可解释和可验证创新方面的性能。

Comments 15pages, 4figures, code available on Github

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16203 2026-03-11 cs.AI 57%

Logic Explanation of AI Classifiers by Categorical Explaining Functors

通过范畴解释函子解释AI分类器的逻辑

Stefano Fioravanti, Francesco Giannini, Paolo Frazzetto, Fabio Zanasi, Pietro Barbiero

机构 * University of Padova(帕多瓦大学) Scuola Normale Superiore(正常大学) University College London(伦敦大学学院) Università della Svizzera Italiana(意大利瑞士大学)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出基于范畴论的解释函子,以确保AI分类器解释的一致性和保真度,通过逻辑规则生成更可靠的解释。

详情

展开后加载摘要…

URL PDF HTML 收藏