arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-04-16 至 2026-04-16 共收录 2 信号源:cs.CL, cs.AI, cs.LG

1. 代码与定理证明 2 篇

2604.02709 2026-04-16 cs.CL cs.AI cs.LG cs.SE 82%

Evaluating the Formal Reasoning Capabilities of Large Language Models through Chomsky Hierarchy

通过乔姆斯基层级评估大语言模型的正式推理能力

Yihong Dong, Jianha Xiao, Xue Jiang, Xuyuan Guo, Zhiyuan Fan, Jiaru Qian, Kechi Zhang, Jia Li, Zhi Jin, Ge Li

机构 * Peking University(北京大学) Wuhan University(武汉大学)

专题命中 代码与定理证明 :reasoning(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出ChomskyBench基准,通过乔姆斯基层级系统评估大语言模型的正式推理能力,揭示其在结构化语言处理中的性能分层及效率瓶颈。

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02811 2026-04-16 cs.AR cs.AI 57%

ChatSVA: Bridging SVA Generation for Hardware Verification via Task-Specific LLMs

ChatSVA: 通过任务特定的LLM桥接SVA生成用于硬件验证

Lik Tung Fu, Jie Zhou, Shaokai Ren, Mengli Zhang, Jia Xiong, Hugo Jiang, Nan Guan, Xi Wang, Jun Yang

机构 * National ASIC Center, School of Integrated Circuits, Southeast University, China(国家集成电路中心,东南大学集成电路学院,中国) National Center of Technology Innovation for Electronic Design Automation, China(电子设计自动化技术创新国家中心,中国) Department of Computer Science, City University of Hong Kong, Hong Kong, China(计算机科学系,香港城市大学,香港,中国)

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI

AI总结 ChatSVA利用多智能体框架生成SVA,实现98.66%的语法正确率和96.12%的功能通过率,功能覆盖率提升33.3个百分点,建立了一个在少样本、领域特定场景中解决长链推理问题的稳健框架。

Comments Accepted by DAC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏