arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-04-06 至 2026-04-06 共收录 8 信号源:cs.CL, cs.AI, cs.LG

1. 逻辑推理 8 篇

2604.02699 2026-04-06 cs.CL cs.AI 81%

Trivial Vocabulary Bans Improve LLM Reasoning More Than Deep Linguistic Constraints

词汇禁令对LLM推理的提升胜过深层语言约束

Rodney Jehu-Appiah

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 研究通过对比不同词汇禁令对语言模型推理的影响,发现简单禁令比深层语言约束更有效,揭示了输出正则化机制对推理提升的作用。

Comments 19 pages, 10 tables, 3 appendices

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02434 2026-04-06 cs.AI 79%

Compositional Neuro-Symbolic Reasoning

组合式神经符号推理

Anugyan Das, Omkar Ghugarkar, Vishvesh Bhat, Asad Aali

机构 * CoreThink AI Stanford University(斯坦福大学)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.AI

AI总结 本文提出一种结合神经和符号方法的推理框架,通过提取网格对象结构、利用神经先验提出变换候选方案并过滤假设,提升ARC-AGI-2任务表现,无需任务特定微调或强化学习。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02954 2026-04-06 cs.CL cs.AI 73%

LogicPoison: Logical Attacks on Graph Retrieval-Augmented Generation

逻辑毒药:图检索增强生成中的逻辑攻击

Yilin Xiao, Jin Chen, Qinggang Zhang, Yujing Zhang, Chuang Zhou, Longhao Yang, Lingfei Ren, Xin Yang, Xiao Huang

机构 * Southwestern University of Finance and Economics(西南财经大学) The Hong Kong Polytechnic University(香港理工大学)

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract);分类 cs.CL、cs.AI

AI总结 本文提出LogicPoison攻击框架,通过逻辑推理而非注入虚假内容,破坏图检索增强生成系统中的拓扑结构,从而降低其性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02346 2026-04-06 cs.LG cs.AI cs.SE q-bio.BM 73%

DrugPlayGround: Benchmarking Large Language Models and Embeddings for Drug Discovery

DrugPlayGround:大型语言模型和嵌入式在药物发现中的基准测试

Tianyu Liu, Sihan Jiang, Fan Zhang, Kunyang Sun, Teresa Head-Gordon, Hongyu Zhao

机构 * Yale University(耶鲁大学) Broad Institute of MIT and Harvard(麻省理工学院和哈佛大学博德研究所) The Chinese University of Hong Kong(香港中文大学) University of California, Berkeley(加州大学伯克利分校) UC Berkeley(加州大学伯克利分校)

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出DrugPlayGround框架,用于评估大型语言模型在生成药物物理化学特性、药物协同作用等文本描述方面的性能,同时通过专家解释验证模型的化学和生物推理能力。

Comments 29 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02695 2026-04-06 cs.CV 67%

XrayClaw: Cooperative-Competitive Multi-Agent Alignment for Trustworthy Chest X-ray Diagnosis

XrayClaw:协作-竞争多智能体对齐用于可信的胸部X光诊断

Shawn Young, Lijian Xu

机构 * Shenzhen University of Advanced Technology, Shenzhen, China(深圳理工大学,深圳,中国)

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract)

AI总结 本文提出XrayClaw框架,通过协作-竞争架构提升胸部X光诊断的可靠性,实现高准确性和临床推理一致性。

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02734 2026-04-06 cs.AI 57%

Aligning Progress and Feasibility: A Neuro-Symbolic Dual Memory Framework for Long-Horizon LLM Agents

对齐进展与可行性:一种神经符号双记忆框架用于长周期LLM智能体

Bin Wen, Ruoxuan Zhang, Yang Chen, Hongxia Xie, Lan-Zhe Guo

机构 * Nanjing University(南京大学) Jilin University(吉林大学)

专题命中 逻辑推理 :planning(abstract);分类 cs.AI

AI总结 本文提出神经符号双记忆框架,通过分离语义进展指导与逻辑可行性验证,解决长周期任务中进展漂移与可行性违反问题,实验显示在ALFWorld、WebShop和TextCraft上性能优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12643 2026-04-06 cs.AI 57%

Learn to Relax with Large Language Models: Solving Constraint Optimization Problems via Bidirectional Coevolution

通过大语言模型学习放松:通过双向共进化解决约束优化问题

Beidan Liu, Zhengqiu Zhu, Chen Gao, Tianle Pu, Yong Zhao, Wei Qi, Quanjun Yin

机构 * State Key Laboratory of Digital Intelligent Modeling and Simulation, National University of Defense Technology(国防科技大学数字智能建模与仿真国家重点实验室) BNRist, Tsinghua University(清华大学北京信息科学与技术国家研究中心) Department of Industrial Engineering, Tsinghua University(清华大学工业工程系) College of Systems Engineering, National University of Defense Technology(国防科技大学系统工程学院)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出AutoCO方法,结合运筹学约束放松原理与LLM推理,通过双向共进化机制提升复杂约束优化问题的求解能力,实验验证其在硬问题中的优越性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17586 2026-04-06 cs.DB 50%

DeepEye-SQL: A Software-Engineering-Inspired Text-to-SQL Framework

DeepEye-SQL: 一种受软件工程启发的文本到SQL框架

Boyan Li, Chong Chen, Zhujun Xue, Yinan Mei, Yuyu Luo

专题命中 逻辑推理 :reasoning(abstract)

AI总结 DeepEye-SQL通过结构化协作提升文本到SQL的可靠性,采用软件开发生命周期指导,实现73.5%的BIRD-Dev准确率和89.8%的Spider-Test表现,优于现有方法。

Comments SIGMOD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏