arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-04-20 至 2026-04-20 共收录 7 信号源:cs.CL, cs.AI, cs.LG

1. 逻辑推理 7 篇

2604.14334 2026-04-20 q-bio.QM cs.AI 89%

Mamba-SSM with LLM Reasoning for Feature Selection: Faithfulness-Aware Biomarker Discovery

Mamba-SSM结合LLM推理进行特征选择:面向生物标志物发现的可信度意识方法

Pushpa Kumar Balan, Aijing Feng

机构 * Department of Computer Science and Cybersecurity(计算机科学与网络安全系)

专题命中 逻辑推理 :reasoning(title,abstract);CoT(summary_cn,abstract);chain-of-thought(abstract);分类 cs.AI

AI总结 本文研究LLM推理在过滤特征选择中的作用,通过Mamba-SSM提取基因并结合CoT提升预测性能,发现特征筛选能提高AUC并验证部分已知生物标志物。

Comments 9 pages, 4 figures. Accepted at ICLR 2026 Workshop on Logical Reasoning of Large Language Models

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15727 2026-04-20 cs.AI cs.LG cs.LO 87%

Structured Abductive-Deductive-Inductive Reasoning for LLMs via Algebraic Invariants

通过代数不变量实现LLMs的结构归纳-演绎-演绎推理

Sankalp Gilda, Shlok Gilda

机构 * DeepThought Solutions(深思科技) Department of Computer Science University of Florida(佛罗里达大学计算机科学系)

专题命中 逻辑推理 :reasoning(title,abstract);chain-of-thought(abstract);logical reasoning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出通过代数不变量实现LLMs的结构归纳-演绎-演绎推理框架,通过五种代数不变量确保推理链中结论的可靠性,防止逻辑不一致的累积。

Comments 10 pages + 3 pages references. Accepted as a poster at the ICLR 2026 Workshop for LLM Reasoning

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17292 2026-04-20 cs.CL cs.AI 81%

Multi-View Attention Multiple-Instance Learning Enhanced by LLM Reasoning for Cognitive Distortion Detection

多视角注意力多实例学习增强的认知扭曲检测

Jun Seo Kim, Hyemi Kim, Woo Joo Oh, Hongjin Cho, Hochul Lee, Hye Hyeon Kim

机构 * Gachon University(加成大学) Korea Telecom Research(韩国电信研究所) Yonsei University(延世大学)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 本文提出结合大语言模型与多实例学习架构的方法,通过分解情绪、逻辑和行为成分提升认知扭曲检测的可解释性和推理能力。

Comments Accepted to the main conference of ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.20689 2026-04-20 cs.AI cs.CL 62%

WiseMind: a knowledge-guided multi-agent framework for accurate and empathetic psychiatric diagnosis

WiseMind: 一种基于知识的多智能体框架,用于准确且富有同理心的精神病诊断

Yuqi Wu, Guangya Wan, Jingjing Li, Shengming Zhao, Lingfeng Ma, Tianyi Ye, Ion Pop, Yanbo Zhang, Jie Chen

机构 * College of Biomedical Engineering(生物医学工程学院) Fudan University(复旦大学) Department of Electrical and Computer Engineering(电气与计算机工程系) University of Alberta(阿尔伯塔大学) University of Virginia(弗吉尼亚大学) McIntire School of Commerce(麦金尼商学院) School of Data Science(数据科学学院) Department of Psychiatry(精神病学系)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 WiseMind通过整合理性与情感智能体,结合DSM-5知识图谱,提升了精神病诊断的准确性与同理心,其在1206次模拟对话和180次真实交互中达到85.6%的诊断准确率,超越了单智能体方法。

Comments Accepted at npj Digital Medicine (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15736 2026-04-20 cs.CV cs.CL 57%

RefereeBench: Are Video MLLMs Ready to be Multi-Sport Referees

RefereeBench: 视频多模态大语言模型是否准备好成为多项目裁判

Yichen Xu, Yuanhang Liu, Chuhan Wang, Zihan Zhao, jinghan luo, Jianzhe Ma, Wenxuan Wang, Qin Jin

机构 * Renmin University of China(中国人民大学) Sichuan University(四川大学)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.CL

AI总结 本文提出RefereeBench,首个评估多模态大语言模型作为自动体育裁判的基准,通过11项运动925个视频和6475对问答,评估犯规存在、分类、推理、实体感知和时间定位能力,发现当前模型在规则应用和时间定位上表现不足。

Comments Work in Progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15623 2026-04-20 cs.AR 50%

Overmind NSA: A Unified Neuro-Symbolic Computing Architecture with Approximate Nonlinear Activations and Preemptive Memory Bypass

Overmind NSA:一种具有近似非线性激活和抢先记忆绕过功能的统一神经符号计算架构

Weilun Wang, Zirui Wang, Wantong Li

专题命中 逻辑推理 :reasoning(abstract)

AI总结 本文提出Overmind架构,通过Padé近似、抢先记忆绕过和软件栈优化,解决神经符号计算中的计算瓶颈,实现高能效和吞吐量。

Comments Accepted to DAC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15163 2026-04-20 cs.DB 50%

DPC: Training-Free Text-to-SQL Candidate Selection via Dual-Paradigm Consistency

DPC:基于双范式一致性的无训练文本到SQL候选选择

Boyan Li, Ou Ocean Kun Hei, Yue Yu, Yuyu Luo

专题命中 逻辑推理 :self-correction(abstract)

AI总结 本文提出DPC方法,通过双范式一致性框架解决文本到SQL的生成与选择差距问题,利用SLICER和TESTER代理构建最小区分数据库,通过执行一致性验证提升候选选择准确性。

Comments ACL 2026 (Main Track)

详情

展开后加载摘要…

URL PDF HTML 收藏