arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-03-11 至 2026-03-11 共收录 24 信号源:cs.CL, cs.AI, cs.LG

1. 规划推理 24 篇

2503.21735 2026-03-11 cs.SE cs.AI cs.CL cs.MA 88%

GateLens: A Reasoning-Enhanced LLM Agent for Automotive Software Release Analytics

GateLens: 一种增强推理能力的LLM代理用于汽车软件发布分析

Arsham Gholamzadeh Khoee, Shuai Wang, Robert Feldt, Dhasarathy Parthasarathy, Yinan Yu

专题命中 规划推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);planning(abstract)

AI总结 GateLens是一种基于LLM的代理,通过引入关系代数作为中间表示,提升复杂表格数据分析的效率与准确性,适用于汽车软件发布分析领域。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09337 2026-03-11 cs.CV cs.AI 83%

Beyond Scaling: Assessing Strategic Reasoning and Rapid Decision-Making Capability of LLMs in Zero-sum Environments

超越规模:在零和环境中评估大语言模型的战略推理和快速决策能力

Yang Li, Xing Chen, Yutao Liu, Gege Qi, Yanxian BI, Zizhe Wang, Yunjian Zhang, Yao Zhu

专题命中 规划推理 :reasoning(title,abstract);planning(abstract);分类 cs.AI

AI总结 本文提出STAR基准,评估大语言模型在零和环境中的战略推理和快速决策能力,揭示推理深度与及时行动能力的权衡。

Comments Code available

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07528 2026-03-11 cs.CL 83%

TableMind++: An Uncertainty-Aware Programmatic Agent for Tool-Augmented Table Reasoning

TableMind++: 一种面向工具增强表格推理的不确定性感知程序化代理

Mingyue Cheng, Shuo Yu, Chuang Jiang, Xiaoyu Tao, Qingyang Mao, Jie Ouyang, Qi Liu, Enhong Chen

机构 * State Key Laboratory of Cognitive Intelligence(认知智能国家重点实验室)

专题命中 规划推理 :reasoning(title,abstract);planning(abstract);分类 cs.CL

AI总结 TableMind++通过引入不确定性感知推理框架,有效缓解LLM的幻觉问题,提升表格推理的准确性和鲁棒性。

Comments 6 tables, 9 figures. arXiv admin note: text overlap with arXiv:2509.06278

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08814 2026-03-11 cs.RO cs.AI cs.ET cs.MA 83%

Scale-Plan: Scalable Language-Enabled Task Planning for Heterogeneous Multi-Robot Teams

Scale-Plan: 为异构多机器人团队实现可扩展的语言赋能任务规划

Piyush Gupta, Sangjae Bae, Jiachen Li, David Isele

机构 * Honda Research Institute(本田研究院) University of California(加州大学)

专题命中 规划推理 :planning(title,abstract);reasoning(abstract);分类 cs.AI

AI总结 Scale-Plan通过生成紧凑的任务相关问题表示,提升异构多机器人团队的可扩展性和可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09843 2026-03-11 cs.IR 82%

RecThinker: An Agentic Framework for Tool-Augmented Reasoning in Recommendation

RecThinker: 一种用于推荐中的工具增强推理的代理框架

Haobo Zhang, Yutao Zhu, Kelong Mao, Tianhao Li, Zhicheng Dou

专题命中 规划推理 :reasoning(title,abstract);planning(abstract)

AI总结 RecThinker通过动态规划和主动工具调用,提升推荐系统中信息获取和推理能力,实现更优的用户-物品匹配。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09036 2026-03-11 cs.LG 81%

SCALAR: Learning and Composing Skills through LLM Guided Symbolic Planning and Deep RL Grounding

SCALAR:通过LLM引导的符号规划和深度RL接地学习与组合技能

Renos Zabounidis, Yue Wu, Simon Stepputtis, Woojun Kim, Yuanzhi Li, Tom Mitchell, Katia Sycara

专题命中 规划推理 :planning(title,abstract);分类 cs.LG;reasoning(comments)

AI总结 SCALAR通过结合LLM引导的符号规划与深度RL,实现技能学习与组合,显著提升任务完成效率和鲁棒性。

Comments Best Paper Award Honorable Mention at NeurIPS 2025 Workshop on Bridging Language, Agent, and World Models for Reasoning and Planning

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09341 2026-03-11 cs.CL cs.AI 81%

TaSR-RAG: Taxonomy-guided Structured Reasoning for Retrieval-Augmented Generation

TaSR-RAG:基于分类的结构化推理用于检索增强生成

Jiashuo Sun, Yixuan Xie, Jimeng Shi, Shaowen Wang, Jiawei Han

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 TaSR-RAG通过基于分类的结构化推理框架,提升检索增强生成任务的证据选择精度和推理质量。

Comments 14 pages, 7 tables, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08933 2026-03-11 cs.AI cs.IR cs.LG 81%

Interpretable Markov-Based Spatiotemporal Risk Surfaces for Missing-Child Search Planning with Reinforcement Learning and LLM-Based Quality Assurance

可解释的基于马尔可夫的时空风险表面用于缺失儿童搜索规划的强化学习与基于LLM的质量保证

Joshua Castillo, Ravi Mukkamala

机构 * Old Dominion University(老奥尔巴尼大学)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI、cs.LG

AI总结 Guardian系统利用马尔可夫链、强化学习和LLM进行可解释的时空风险建模,以提升失踪儿童搜索规划的效率和准确性。

Comments 14 pages, 7 figures. Accepted at ICEIS 2026 (International Conference on Enterprise Information Systems)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02154 2026-03-11 cs.MA cs.AI 79%

Boltzmann-based Exploration for Robust Decentralized Multi-Agent Planning (Extended Version)

基于玻尔兹曼的探索用于鲁棒的去中心化多智能体规划(扩展版)

Nhat D. A. Nguyen, Duong D. Nguyen, Gianluca Rizzo, Hung X. Nguyen

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 本文提出CB-MCTS,通过玻尔兹曼策略和熵奖励提升多智能体规划的鲁棒性,在欺骗场景中表现更优。

Comments To appear in ICAPS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.24235 2026-03-11 cs.RO cs.AI 79%

SafeGen-LLM: Enhancing Safety Generalization in Task Planning for Robotic Systems

SafeGen-LLM: 提高机器人系统任务规划中的安全性泛化能力

Jialiang Fan, Weizhe Xu, Mengyu Liu, Oleg Sokolsky, Insup Lee, Fanxin Kong

机构 * University of Notre Dame(诺丁汉大学) Washington State University(华盛顿州立大学) University of Pennsylvania(宾夕法尼亚大学)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 SafeGen-LLM通过两阶段框架提升机器人任务规划的安全性泛化能力,优于现有基线。

Comments 12 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08987 2026-03-11 cs.LG 79%

MAPLE: Elevating Medical Reasoning from Statistical Consensus to Process-Led Alignment

MAPLE:从统计共识到过程导向对齐的医学推理提升

Kailong Fan, Anqi Pu, Yichen Wu, Wanhua Li, Yicong Li, Hanspeter Pfister, Huafeng Liu, Xiang Li, Quanzheng Li, Ning Guo

机构 * Zhejiang University(浙江大学) Harvard University(哈佛大学) Harvard Medical School(哈佛医学院)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.LG

AI总结 MAPLE通过整合医学过程奖励模型与TTRL,提升医学推理的准确性和可靠性,实现从统计共识到过程导向对齐的转变。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08921 2026-03-11 cs.CV cs.LG 79%

Vision-Language Models Encode Clinical Guidelines for Concept-Based Medical Reasoning

视觉-语言模型编码临床指南以实现基于概念的医学推理

Mohamed Harmanani, Bining Long, Zhuoxin Guo, Paul F. R. Wilson, Amirhossein Sabour, Minh Nguyen Nhat To, Gabor Fichtinger, Purang Abolmaesumi, Parvin Mousavi

机构 * Queen’s University(女王大学) University of British Columbia(不列颠哥伦比亚大学) McMaster University(麦马斯特大学) Vector Institute(向量研究所)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.LG

AI总结 MedCBR通过整合临床指南与视觉-语言模型,提升医学影像诊断的可解释性和决策支持能力。

Comments CVPR 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09743 2026-03-11 cs.CV 78%

LAP: A Language-Aware Planning Model For Procedure Planning In Instructional Videos

LAP:一种语言感知的规划模型用于教学视频中的过程规划

Lei Shi, Victor Aregbede, Andreas Persson, Martin Längkvist, Amy Loutfi, Stephanie Lowry

机构 * Örebro University(奥雷布罗大学)

专题命中 规划推理 :planning(title,abstract)

AI总结 LAP通过利用语言描述提升过程规划的准确性,实现教学视频中动作序列的高效生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09188 2026-03-11 cs.RO 78%

Robust Spatiotemporal Motion Planning for Multi-Agent Autonomous Racing via Topological Gap Identification and Accelerated MPC

多智能体自主赛车中鲁棒时空运动规划 via 拓扑间隙识别与加速MPC

Mingyi Zhang, Cheng Hu, Yiqin Wang, Haotong Qin, Hongye Su, Lei Xie

机构 * Department of Control Science and Engineering, Zhejiang University(浙江大学控制科学与工程学院) Center for Project-Based Learning, D-ITET, ETH Zurich(苏黎世联邦理工学院项目导向学习中心)

专题命中 规划推理 :planning(title,abstract)

AI总结 本文提出基于拓扑间隙识别与加速MPC的框架,通过预测对手行为和动态占用走廊,实现高速多智能体自主赛车中鲁棒的时空规划与高精度控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09031 2026-03-11 cs.RO 78%

ImpedanceDiffusion: Diffusion-Based Global Path Planning for UAV Swarm Navigation with Generative Impedance Control

阻抗扩散:基于扩散的全局路径规划用于无人机群导航的生成阻抗控制

Faryal Batool, Yasheerah Yaqoot, Muhammad Ahsan Mustafa, Roohan Ahmed Khan, Aleksey Fedoseev, Dzmitry Tsetserukou

机构 * Intelligent Space Robotics Laboratory, Center for Digital Engineering, Skolkovo Institute of Science and Technology(智能空间机器人实验室,数字工程中心,斯克尔科夫科学与技术研究所)

专题命中 规划推理 :planning(title,abstract)

AI总结 ImpedanceDiffusion通过结合扩散模型和人工势场跟踪,实现无人机群在复杂环境中的可靠路径规划与自适应阻抗控制。

Comments This is paper is under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08988 2026-03-11 cs.RO 78%

Characterization, Analytical Planning, and Hybrid Force Control for the Inspire RH56DFX Hand

Inspire RH56DFX手的表征、分析规划与混合力控

Xuan Tan, William Xie, Nikolaus Correll

机构 * Department of Computer Science, University of Colorado Boulder(计算机科学系,科罗拉多大学博尔德分校)

专题命中 规划推理 :planning(title,abstract)

AI总结 本文通过硬件表征、MuJoCo模型和混合力控方法改进Inspire RH56DFX手,提升其在抓取任务中的性能和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09481 2026-03-11 cs.AI 77%

GenePlan: Evolving Better Generalized PDDL Plans using Large Language Models

GenePlan: 利用大语言模型改进PDDL计划的进化方法

Andrew Murray, Danial Dervovic, Alberto Pozanco, Michael Cashmore

专题命中 规划推理 :chain-of-thought(abstract);CoT(abstract);planning(abstract);分类 cs.AI

AI总结 GenePlan利用大语言模型改进PDDL计划的进化方法,通过优化问题生成高效且低成本的通用计划器,实现了与最先进方法相近的性能。

Comments 54 pages, 4 figures. Accepted to ICAPS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.18988 2026-03-11 cs.CL 77%

Markovian Transformers for Informative Language Modeling

马尔可夫变换器用于信息语言建模

Scott Viteri, Max Lamparth, Peter Chatain, Clark Barrett

机构 * Department of Computer Science Stanford University(计算机科学系 斯坦福大学)

专题命中 规划推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL

AI总结 马尔可夫变换器通过引入CoT瓶颈提升语言模型的推理能力,实验显示其在问答任务中表现优异,且对CoT依赖性强。

Comments 21 pages, 6 figures, Accepted at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15242 2026-03-11 cs.LG 77%

Bradley-Terry Policy Optimization for Generative Preference Modeling

基于布雷德利-蒂尔利模型的生成偏好建模政策优化

Shengyu Feng, Yun He, Shuang Ma, Beibin Li, Yuanhao Xiong, Songlin Li, Karishma Mandyam, Julian Katz-Samuels, Shengjie Bi, Licheng Yu, Hejia Zhang, Karthik Abinav Sankararaman, Han Fang, Yiming Yang, Manaal Faruqui

专题命中 规划推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.LG

AI总结 本文提出布雷德利-蒂尔利政策优化(BTPO),通过引入链式推理改变偏好建模的似然结构,实现对生成偏好模型的有效训练。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12667 2026-03-11 cs.AI 70%

Empowering All-in-Loop Health Management of Spacecraft Power System in the Mega-Constellation Era via Human-AI Collaboration

通过人机协作赋能航天器电力系统在 mega-星座时代中的全闭环健康管理

Yi Di, Zhibin Zhao, Fujin Wang, Xue Liu, Jiafeng Tang, Jiaxin Ren, Zhi Zhai, Xuefeng Chen

专题命中 规划推理 :reasoning(abstract);logical reasoning(abstract);分类 cs.AI

AI总结 本文提出了一种基于人机协作的航天器电力系统全闭环健康管理框架,通过开源工具和数据集实现了高效的健康管理与故障诊断。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08954 2026-03-11 cs.AI cs.CL cs.DC cs.IR cs.LG 67%

A Consensus-Driven Multi-LLM Pipeline for Missing-Person Investigations

基于共识的多语言模型流水线用于失踪人员调查

Joshua Castillo, Ravi Mukkamala

专题命中 规划推理 :planning(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出了一种基于共识的多语言模型流水线,用于失踪人员调查,通过协调多个任务专用的 LLM 模型和共识引擎,提升信息提取和处理的效率与准确性。

Comments Accepted to CAC: Applied Computing & Automation Conferences 2026. 16 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09916 2026-03-11 eess.SY cs.AI cs.SY 57%

AI-Enabled Data-driven Intelligence for Spectrum Demand Estimation

基于人工智能的数据驱动智能用于频谱需求估计

Colin Brown, Mohamad Alkadamani, Halim Yanikomeroglu

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文提出基于人工智能的数据驱动方法,利用机器学习模型准确预测频谱需求,通过验证代理提升预测精度,助力频谱资源的动态规划与管理。

Comments Presented at an IEEE ICC 2025 Workshop and published in the conference proceedings

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09716 2026-03-11 cs.AI 57%

AutoAgent: Evolving Cognition and Elastic Memory Orchestration for Adaptive Agents

AutoAgent:为自适应智能体演化认知与弹性记忆编排

Xiaoxing Wang, Ning Liao, Shikun Wei, Chen Tang, Feiyu Xiong

机构 * MemTensor (Shanghai) Technology Co., Ltd.(MemTensor(上海)科技有限公司) Shanghai Jiao Tong University(上海交通大学) Institute for Advanced Algorithms Research, Shanghai(上海先进算法研究所)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 AutoAgent通过自我进化多智能体框架,实现动态认知演化与弹性记忆编排,提升智能体在动态环境中的适应性和任务执行效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09250 2026-03-11 cs.IR 50%

Evoking User Memory: Personalizing LLM via Recollection-Familiarity Adaptive Retrieval

唤起用户记忆:通过回忆-熟悉度适应检索个性化LLM

Yingyi Zhang, Junyi Li, Wenlin Zhang, Penyue Jia, Xianneng Li, Yichao Wang, Derong Xu, Yi Wen, Huifeng Guo, Yong Liu, Xiangyu Zhao

专题命中 规划推理 :reasoning(abstract)

AI总结 RF-Mem通过双路径记忆检索实现个性化LLM,结合回忆与熟悉度机制提升记忆检索效率和准确性。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏