arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-04-03 至 2026-04-03 共收录 6 信号源:cs.CL, cs.AI, cs.LG

1. 逻辑推理 6 篇

2603.02788 2026-04-03 cs.AI 89%

Agentified Assessment of Logical Reasoning Agents

具有代理特性的逻辑推理代理评估

Zhiyu Ni, Yifeng Xiao, Zheng Liang

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);chain-of-thought(abstract);分类 cs.AI

AI总结 本文提出一种评估和基准测试逻辑推理代理的框架,通过代理评估实现可重复、可审计和抗执行失败的评估。案例研究中,自动形式化代理在FOLIO验证集上以86.70%的准确率超越了基线方法。

Comments Accepted at ICLR 2026 Agents in the Wild (AIWILD) Workshop. 5 pages, 2 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21736 2026-04-03 cs.AI cs.CL 81%

The Reasoning Error About Reasoning: Why Different Types of Reasoning Require Different Representational Structures

推理中的推理错误:为何不同类型的推理需要不同的表示结构

Yiling Wu

机构 * BridgeM, Inc.(BridgeM公司) Department of Philosophy, University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校哲学系)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 本文探讨不同推理类型对表示系统结构需求的差异,提出四个结构性质,并指出结构保证对推理类型的重要性,支持了结构重组的必要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02154 2026-04-03 cs.HC 78%

Designing Transformational Games to Support Socio-ethical Reasoning about Generative AI

设计转型游戏以支持关于生成式人工智能的社伦理推理

Jaemarie Solyst, Ruth Karen Nakigozi, Chloe Fong, R. Benjamin Shapiro

专题命中 逻辑推理 :reasoning(title,abstract)

AI总结 本文设计了两款游戏,通过同伴评估、基于约束的创造力和社会推理元素,促进青少年对生成式人工智能的社伦理推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02238 2026-04-03 cs.CY cs.AI stat.AP 57%

Generative AI Spotlights the Human Core of Data Science: Implications for Education

生成AI揭示数据科学的人类核心:对教育的影响

Nathan Taback

机构 * University of Toronto(多伦多大学)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI

AI总结 生成AI揭示数据科学中不可还原的人类核心,教育应强化人类推理能力,通过迭代提示-输出-提示循环提升学生贡献能力,评估应侧重推理与判断。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01738 2026-04-03 cs.AI 57%

AeroTherm-GPT: A Verification-Centered LLM Framework for Thermal Protection System Engineering Workflows

AeroTherm-GPT:一种面向热防护系统工程工作流的验证中心LLM框架

Chuhan Qiao, Jinglai Zheng, Jie Huang, Buyue Zhao, Fan Li, Haiming Huang

机构 * School of Civil Engineering, Beijing Jiaotong University(北京交通大学土木工程学院) Beijing Research Institute of Telemetry(北京遥测技术研究所)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出AeroTherm-GPT,一种专为热防护系统设计的LLM代理,通过约束闭环生成框架解决超音速热防护系统设计中生成可执行仿真工具时的约束冲突问题,实现高效率的根因修复。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01520 2026-04-03 cs.AI 57%

LLM Agents as Social Scientists: A Human-AI Collaborative Platform for Social Science Automation

LLM代理作为社会科学家:一种人机协作的社会科学自动化平台

Lei Wang, Yuanzi Li, Jinchao Wu, Heyang Gao, Xiaohe Bo, Xu Chen, Ji-Rong Wen

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学高瓴人工智能学院) Beijing Key Laboratory of Big Data Management and Analysis Methods(大数据管理与分析方法北京市重点实验室)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出S-Researcher平台,通过LLM代理实现社会科学研究的高效化与规模化,结合自动编程、分布式架构和反馈驱动微调,构建人机协作的研究闭环,验证了三种推理模式在社会科学中的应用。

详情

展开后加载摘要…

URL PDF HTML 收藏