arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-03-16 至 2026-03-16 共收录 6 信号源:cs.CL, cs.AI, cs.LG

1. 逻辑推理 6 篇

2603.11279 2026-03-16 cs.AI 88%

AI Psychometrics: Evaluating the Psychological Reasoning of Large Language Models with Psychometric Validities

AI心理测量学:通过心理测量效度评估大型语言模型的心理推理能力

Yibai Li, Xiaolin Lin, Zhenghui Sha, Zhiye Jin, Xiaobing Li

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.AI

AI总结 本文通过心理测量学方法评估四个主流LLM的心理推理能力和整体效度,发现高性能模型在效度上优于其 predecessors,验证了AI心理测量学的应用价值。

Comments Accepted for publication in the Proceedings of the 58th Hawaii International Conference on System Sciences (HICSS), 2025

Journal ref Proceedings of the 58th Hawaii International Conference on System Sciences (HICSS), January 2025, pp. 5189-5197

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12808 2026-03-16 cs.LG 85%

A Multi-task Large Reasoning Model for Molecular Science

分子科学的多任务大规模推理模型

Pengfei Liu, Shuang Ge, Jun Tao, Zhixiang Ren

机构 * Pengcheng Laboratory(鹏城实验室) School of Computer Science and Engineering, Sun Yat-sen University(中山大学计算机科学与工程学院) Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生学院)

专题命中 逻辑推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.LG

AI总结 本文提出多任务大规模推理模型,结合科学逻辑与深度学习,通过强化学习提升分子推理能力,在10项任务中实现50.3%的性能提升,验证了显式推理机制的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12953 2026-03-16 cs.LO cs.AI 79%

Delta1 with LLM: symbolic and neural integration for credible and explainable reasoning

Delta1与LLM:符号与神经整合用于可信且可解释的推理

Yang Xu, Jun Liu, Shuwei Chen, Chris Nugent, Hailing Guo

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.AI

AI总结 本文提出Delta1与LLM结合的框架,通过符号推理与神经网络整合,实现可信且可解释的推理,适用于医疗、合规和监管领域。

Comments 12 pages, 1 figure, 3 tables, accepted oral presentation at AAAI2026 Bridge Program on Logic & AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13201 2026-03-16 cs.CL 70%

Neuron-Aware Data Selection In Instruction Tuning For Large Language Models

面向神经元的数据选择用于大语言模型的指令微调

Xin Chen, Junchao Wu, Shu Yang, Runzhe Zhan, Zeyu Wu, Min Yang, Shujian Huang, Lidia S. Chao, Derek F. Wong

机构 * NLP CT Lab, Department of Computer and Information Science, University of Macau(计算机与信息科学系,澳门大学CT实验室) Artificial Intelligence Research Institute, Shenzhen University of Advanced Technology(深圳先进技术大学人工智能研究院) Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究所) Provable Responsible AI and Data Analytics Lab, KAUST(可证明责任AI与数据分析实验室,卡尔斯兰大学) National Key Laboratory for Novel Software Technology, Nanjing University(新型软件技术国家重点实验室,南京大学)

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract);分类 cs.CL

AI总结 本文提出NAIT框架,通过分析神经元激活模式相似性选择高效指令微调数据,提升大语言模型特定或通用能力,实验证明其在多种任务中优于其他方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12305 2026-03-16 cs.LG cs.AI 62%

HCP-DCNet: A Hierarchical Causal Primitive Dynamic Composition Network for Self-Improving Causal Understanding

HCP-DCNet:一种用于自我改进因果理解的分层因果原语动态组合网络

Ming Lei, Shufan Wu, Christophe Baehr

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出HCP-DCNet,通过分层因果原语动态组合网络实现因果理解的自我改进,提升因果发现、反事实推理和组合泛化能力。

Comments 17 pages, 2 figures, submitted to a journal and under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12487 2026-03-16 cs.LG 57%

Modal Logical Neural Networks for Financial AI

模态逻辑神经网络用于金融AI

Antonin Sulc

机构 * Lawrence Berkeley National Lab(伯克利国家实验室)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.LG

AI总结 本文提出模态逻辑神经网络,结合模态语义与神经网络,解决金融AI中深度学习与符号逻辑的矛盾,通过监管护栏、市场压力测试等应用提升合规性与鲁棒性。

Comments 4 pages, 1 figure, Accepted at ICLR 2026 FinAI

详情

展开后加载摘要…

URL PDF HTML 收藏