arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-03-04 至 2026-03-04 共收录 15 信号源:cs.CL, cs.AI, cs.LG

1. 规划推理 15 篇

2603.02436 2026-03-04 cs.CR 87%

TraceGuard: Process-Guided Firewall against Reasoning Backdoors in Large Language Models

TraceGuard: 用于对抗大语言模型推理后门的过程引导防火墙

Zhen Guo, Shanghao Shi, Hao Li, Shamim Yazdani, Ning Zhang, Reza Tourani

专题命中 规划推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);verifier(abstract)

AI总结 TraceGuard通过过程引导框架提升大语言模型的推理安全性,有效对抗推理后门。

Comments 20 pages,10 figures,6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14899 2026-03-04 cs.RO cs.CL 86%

REFLEX: Metacognitive Reasoning for Reflective Zero-Shot Robotic Planning with Large Language Models

REFLEX:基于大语言模型的反思零样本机器人规划的元认知推理

Wenjie Lin, Jin Wei-Kocsis, Jiansong Zhang, Byung-Cheol Min, Dongming Gan, Paul Asunda, Ragu Athinarayanan

机构 * School of Applied and Creative Computing, Purdue University(应用与创意计算学院,普渡大学) Bowen School of Construction, Purdue University(建设学院,普渡大学) School of Engineering Technology, Purdue University(工程技术学院,普渡大学) Department of Technology Leadership and Innovation, Purdue University(技术领导与创新部门,普渡大学)

专题命中 规划推理 :planning(title,abstract);reasoning(title);分类 cs.CL

AI总结 REFLEX通过引入元认知学习,提升大语言模型在机器人任务中的推理、反思与创造力,实现零样本下的高效规划。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13180 2026-03-04 cs.AI 85%

ViPlan: A Benchmark for Visual Planning with Symbolic Predicates and Vision-Language Models

ViPlan:一个用于视觉规划的基准,结合符号谓词和视觉-语言模型

Matteo Merler, Nicola Dainese, Minttu Alakuijala, Giovanni Bonetta, Pietro Ferrazzi, Yu Tian, Bernardo Magnini, Pekka Marttinen

机构 * Fondazione Bruno Kessler(布鲁诺·科塞拉基金会) Department of Computer Science, Aalto University(艾尔沃斯大学计算机科学系) Department of Mathematics, Università degli Studi di Padova(帕多瓦大学数学系)

专题命中 规划推理 :planning(title,abstract);reasoning(abstract);chain-of-thought(abstract);分类 cs.AI

AI总结 ViPlan是一个用于视觉规划的基准,比较基于VLMs的符号方法与直接VLM规划方法,发现不同方法在不同任务中的表现差异。

Comments 8 pages, 5 figures and 1 table in the main text; 50 pages, 16 figures and 19 tables including supplementary material

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22613 2026-03-04 cs.AI cs.CL cs.LG stat.ML 82%

Benefits and Pitfalls of Reinforcement Learning for Language Model Planning: A Theoretical Perspective

强化学习在语言模型规划中的利弊:一种理论视角

Siwei Wang, Yifei Shen, Haoran Sun, Shi Feng, Shang-Hua Teng, Li Dong, Yaru Hao, Wei Chen

机构 * Microsoft Research Asia(微软亚洲研究院) Peking University(北京大学) Harvard University(哈佛大学) University of Southern California(南加州大学)

专题命中 规划推理 :planning(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文从理论角度分析强化学习在语言模型规划中的利弊,揭示探索的重要性及Q学习在多样性保持方面的优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02669 2026-03-04 cs.RO 82%

IMR-LLM: Industrial Multi-Robot Task Planning and Program Generation using Large Language Models

IMR-LLM:基于大语言模型的工业多机器人任务规划与程序生成

Xiangyu Su, Juzhan Xu, Oliver van Kaick, Kai Xu, Ruizhen Hu

机构 * Shenzhen University(深圳大学) SpeedBot Robotics Co., Ltd.(SpeedBot机器人科技有限公司) Carleton University(卡尔顿大学) Institute of AI for Industries, Chinese Academy of Sciences(中国科学院工业人工智能研究所)

专题命中 规划推理 :planning(title,abstract);reasoning(abstract)

AI总结 IMR-LLM通过大语言模型实现工业多机器人任务规划与程序生成,结合析取图和过程树,提出高效任务计划和可执行程序生成方法,并构建了多复杂度层次的IMR-Bench基准。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02635 2026-03-04 cs.LG 79%

SaFeR-ToolKit: Structured Reasoning via Virtual Tool Calling for Multimodal Safety

SaFeR-ToolKit: 通过虚拟工具调用实现多模态安全的结构化推理

Zixuan Xu, Tiancheng He, Huahui Yi, Kun Wang, Xi Chen, Gongli Xi, Qiankun Li, Kang Li, Yang Liu, Zhigang Zeng

机构 * Huazhong University of Science and Technology(华中科技大学) Beijing University of Posts and Telecommunications(北京邮电大学) West China Hospital, Sichuan University(四川大学华西医院) Nanyang Technological University(南洋理工大学)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.LG

AI总结 SaFeR-ToolKit通过虚拟工具调用实现多模态安全的结构化推理,提升安全性、帮助性和推理严谨性,同时保持通用能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02514 2026-03-04 cs.HC 78%

Probing More-Than-Human Representation in Crisis Resilience Planning: An HCI Researcher Perspective

在危机韧性规划中探查超人类表征:人机交互研究者视角

Tram Thi Minh Tran, Adrian Wong, Callum Parker, Carlos Alfredo Tirado Cortes, Marius Hoggenmueller, Soojeong Yoo, Nate Zettna, Joel Fredericks

专题命中 规划推理 :planning(title,abstract)

AI总结 本文从人机交互研究者视角探讨危机韧性规划中如何通过设计探查实现非人类视角的表征,揭示了超人类表征设计中的张力与挑战。

Comments Accepted into CHI 2026 Posters track

详情

展开后加载摘要…

URL PDF HTML 收藏
2204.14133 2026-03-04 cs.NI cs.AI cs.LG 73%

Network Topology Optimization via Deep Reinforcement Learning

通过深度强化学习进行网络拓扑优化

Zhuoran Li, Xing Wang, Ling Pan, Lin Zhu, Zhendong Wang, Junlan Feng, Chao Deng, Longbo Huang

机构 * IIIS, Tsinghua University(清华大学信息科学与技术学院) China Mobile Research Institute(中国移动研究院)

专题命中 规划推理 :planning(abstract);verifier(abstract);分类 cs.AI、cs.LG

AI总结 本文提出DRL-GS算法,通过深度强化学习优化网络拓扑,提升效率与性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02688 2026-03-04 cs.AI cs.RO 70%

Retrieval-Augmented Robots via Retrieve-Reason-Act

通过检索-推理-行动实现增强型机器人

Izat Temiraliev, Diji Yang, Yi Zhang

机构 * University of California, Santa Cruz(加州大学圣克ruz分校)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.AI

AI总结 本文提出检索增强型机器人学(RAR)范式,通过检索-推理-行动循环,使机器人能从外部文档获取未见程序知识,提升复杂任务执行能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02623 2026-03-04 cs.RO cs.LG 70%

Uni-Skill: Building Self-Evolving Skill Repository for Generalizable Robotic Manipulation

Uni-Skill:构建通用机器人操作的自演化技能库

Senwei Xie, Yuntian Zhang, Ruiping Wang, Xilin Chen

机构 * Key Laboratory of AI Safety of CAS(中国科学院人工智能安全重点实验室) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.LG

AI总结 Uni-Skill通过自演化技能库提升机器人操作的通用性与适应性,实现高效技能检索与少样本推理。

Comments Accepted to ICRA2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03148 2026-03-04 cs.RO 67%

From Language to Action: Can LLM-Based Agents Be Used for Embodied Robot Cognition?

从语言到行动:基于大语言模型的代理能否用于具身机器人认知?

Shinas Shaji, Fabian Huppertz, Alex Mitrevski, Sebastian Houben

机构 * Institute of AI and Autonomous Systems (A 2 S)(人工智能与自主系统研究所) Hochschule Bonn-Rhein-Sieg(波恩-莱茵-锡格大学) Division for Systems and Control(系统与控制系) Chalmers University of Technology(查尔姆斯理工大学) Fraunhofer Institute for Intelligent Analysis and Information Systems(弗劳恩霍夫智能分析与信息系统研究所)

专题命中 规划推理 :reasoning(abstract);planning(abstract)

AI总结 本文研究了基于大语言模型的代理在家庭任务中的表现,探讨其在具身机器人认知中的潜力与挑战。

Comments Accepted for publication at the 2026 IEEE International Conference on Robotics and Automation (ICRA)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02888 2026-03-04 cs.CV 67%

LLandMark: A Multi-Agent Framework for Landmark-Aware Multimodal Interactive Video Retrieval

LLandMark:一种用于地标感知多模态交互视频检索的多智能体框架

Minh-Chi Phung, Thien-Bao Le, Cam-Tu Tran-Thi, Thu-Dieu Nguyen-Thi, Vu-Hung Dao

机构 * AI VIETNAM(AI越南)

专题命中 规划推理 :reasoning(abstract);planning(abstract)

AI总结 LLandMark通过多智能体框架实现地标感知的多模态视频检索,结合LLM和OCR技术提升文化场景下的检索能力与可解释性。

Comments Accepted by AAAI 2026 Workshop on New Frontiers in Information Retrieval

Journal ref AAAI 2026 Workshop on New Frontiers in Information Retrieval

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02519 2026-03-04 cs.MM cs.IR 67%

Agentic Mixed-Source Multi-Modal Misinformation Detection with Adaptive Test-Time Scaling

具有自适应测试时间缩放的代理混合源多模态虚假信息检测

Wei Jiang, Tong Chen, Wei Yuan, Quoc Viet Hung Nguyen, Hongzhi Yin

专题命中 规划推理 :reasoning(abstract);planning(abstract)

AI总结 AgentM3D通过自适应测试时间缩放和多代理框架提升零样本多模态虚假信息检测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06412 2026-03-04 astro-ph.IM cs.AI cs.CL 62%

StarWhisper Telescope: An AI framework for automating end-to-end astronomical observations

StarWhisper望远镜:一种用于自动化端到端天文观测的AI框架

Cunshi Wang, Yu Zhang, Yuyang Li, Xinjie Hu, Yiming Mao, Xunhao Chen, Pengliang Du, Rui Wang, Ying Wu, Hang Yang, Yansong Li, Beichuan Wang, Haiyang Mu, Zheng Wang, Jianfeng Tian, Liang Ge, Yongna Mao, Shengming Li, Xiaomeng Lu, Jinhang Zou, Yang Huang, Ningchen Sun, Jie Zheng, Min He, Yu Bai, Junjie Jin, Hong Wu, Jifeng Liu

机构 * University of Chinese Academy of Sciences(中国科学院大学) Key Laboratory of Optical Astronomy National Astronomical Observatories Chinese Academy of Sciences(中国科学院国家天文台光学天文重点实验室) School of Computing Science Simon Fraser University(西蒙弗雷泽大学计算机科学学院) College of Science Tibet University(西藏大学理学院) Institute for Frontiers in Astronomy and Astrophysics Beijing Normal University(北京师范大学前沿天文与天体物理研究院) Liii Network Co(Liii网络公司)

专题命中 规划推理 :planning(abstract);分类 cs.CL、cs.AI

AI总结 StarWhisper望远镜是一种结合大语言模型与模块化工作流的AI框架,用于自动化天文观测,提升观测效率并促进业余与专业天文学家的协作。

Comments 33 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02680 2026-03-04 cs.AI 57%

LLMs for High-Frequency Decision-Making: Normalized Action Reward-Guided Consistency Policy Optimization

基于大语言模型的高频决策:归一化动作奖励引导的一致性策略优化

Yang Zhao, Zihao Li, Zhiyu Jiang, Dandan Ma, Ganchao Liu, Wenzhe Zhao

机构 * School of Artificial Intelligence, OPtics and ElectroNics (iOPEN), Northwestern Polytechnical University(人工智能学院、光学和电子学(iOPEN)、西北工业大学)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文提出NAR-CP方法,通过归一化动作奖励和一致性损失优化,提升高频决策任务中的策略一致性与泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏