arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-03-20 至 2026-03-20 共收录 22 信号源:cs.CL, cs.AI, cs.LG

1. 规划推理 22 篇

2410.09252 2026-03-20 cs.CL cs.AI cs.HC 84%

DAVIS: Planning Agent with Knowledge Graph-Powered Inner Monologue

DAVIS:基于知识图谱的规划代理

Minh Pham Dinh, Munira Syed, Michael G Yankoski, Trenton W. Ford

机构 * Davis Institute for Artificial Intelligence(戴维斯人工智能研究所) Colby College(科伯学院) University of Notre Dame(圣约翰大学) William & Mary(威廉与玛丽学院)

专题命中 规划推理 :planning(title,abstract);reasoning(abstract);分类 cs.CL、cs.AI

AI总结 本文提出DAVIS,一种基于知识图谱的规划代理,通过结构化和时间记忆实现模型驱动规划,并采用多轮检索系统提升科学任务处理能力,在ScienceWorld基准测试中表现优异。

Comments Accepted to EMNLP 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15888 2026-03-20 cs.AI cs.CV cs.RO 83%

AsgardBench -- Evaluating Visually Grounded Interactive Planning Under Minimal Feedback

AsgardBench -- 评估基于视觉的交互式规划在最小反馈下的表现

Andrea Tupini, Lars Liden, Reuben Tan, Yu Wang, Jianfeng Gao

机构 * Microsoft(微软)

专题命中 规划推理 :planning(title,abstract);reasoning(abstract);分类 cs.AI

AI总结 AsgardBench旨在评估基于视觉的高阶动作序列生成和交互式规划,重点在于执行过程中基于视觉观察而非导航或低级操作的计划适应。通过限制代理输入为图像、动作历史和轻量级成功/失败信号,该基准测试强调条件分支和计划修复。

Comments 19 figures, 6 tables, including appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18470 2026-03-20 cs.HC 82%

CyberJustice Tutor: An Agentic AI Framework for Cybersecurity Learning via Think-Plan-Act Reasoning and Pedagogical Scaffolding

网络正义导师:一种基于思考-计划-行动推理和教学支架的AI框架,用于网络安全学习

Baiqiang Wang, Yan Bai, Juan Li

专题命中 规划推理 :reasoning(title,abstract);planning(abstract)

AI总结 本文提出CyberJustice Tutor,通过Think-Plan-Act推理和教学支架框架,解决传统聊天机器人在网络安全教育中的局限性,验证了其在专业教育中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11103 2026-03-20 cs.SE 80%

Understanding by Reconstruction: Reversing the Software Development Process for LLM Pretraining

通过重构理解:为LLM预训练反转软件开发过程

Zhiyuan Zeng, Yichi Zhang, Yong Shan, Kai Hua, Siyuan Fang, Zhaiyu Liu, Jiaheng Liu, Haozhe Wang, Yining Zheng, Ming Ding, Ke Shen, Ge Zhang, Wenhao Huang, Xipeng Qiu

专题命中 规划推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);planning(abstract)

AI总结 本文提出通过重构软件开发过程来提升LLM性能,通过模拟多智能体轨迹生成更丰富的监督信号,实验显示在多个基准测试中效果显著。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19169 2026-03-20 cs.CV cs.AI 79%

ARIADNE: A Perception-Reasoning Synergy Framework for Trustworthy Coronary Angiography Analysis

ARIADNE:一种用于可靠冠状动脉造影分析的感知-推理协同框架

Zhan Jin, Yu Luo, Yizhou Zhang, Ziyang Cui, Yuqing Wei, Xianchao Liu, Xueying Zeng, Qing Zhang

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 ARIADNE通过结合偏好对齐的感知与基于强化学习的诊断推理,实现拓扑一致的狭窄检测。该框架利用DPO微调Sa2VA模型,结合贝蒂数约束,提升血管结构完整性,减少假阳性,验证了偏好学习在医学影像中的应用。

Comments 28 pages, 5 figures . arXiv:submit/7385738 [cs.AI]

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09255 2026-03-20 cs.CL 79%

DSPO: Stable and Efficient Policy Optimization for Agentic Search and Reasoning

DSPO:用于代理搜索和推理的稳定高效策略优化

Chenyang Gu, Yewen Pu, Bruce Yang, Xiaofan Li, Huan Gao

机构 * Sapiens AI Nanyang Technological University(南洋理工大学) National University of Singapore(新加坡国立大学)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.CL

AI总结 DSPO通过序列级优化和动态样本过滤提升代理训练稳定性,使7B模型在多个问答基准上超越前作34.1%,在复杂多跳问答中甚至超越14B模型9个百分点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18958 2026-03-20 cs.GT cs.MA 78%

Optimal Path Planning in Hostile Environments

hostile 环境中的最优路径规划

Andrzej Kaczmarczyk, Šimon Schierreich, Nicholas Axel Tanujaya, Haifeng Xu

专题命中 规划推理 :planning(title,abstract)

AI总结 研究在危险环境中多智能体路径规划问题,证明该问题NP难并提出多项式时间算法,揭示了问题的计算复杂性景观。

Comments Accepted for publication at ICAPS-2026 (25 pages, 6 figures)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18383 2026-03-20 cs.DC 78%

From Servers to Sites: Compositional Power Trace Generation of LLM Inference for Infrastructure Planning

从服务器到站点:LLM推理的组合功率轨迹生成用于基础设施规划

Grant Wilkins, Fiodar Kazhamiaka, Ram Rajagopal

专题命中 规划推理 :planning(title,abstract)

AI总结 本文提出通过组合功率轨迹生成方法,准确建模LLM推理的能耗,支持更精确的基础设施规划。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.08794 2026-03-20 cs.AI 70%

LLM-Based World Models Can Make Decisions Solely, But Rigorous Evaluations are Needed

基于LLM的世界模型可以独立做出决策,但需要严谨的评估

Chang Yang, Xinrun Wang, Junzhe Jiang, Qinggang Zhang, Xiao Huang

机构 * The Hong Kong Polytechnic University(香港理工大学) Singapore Management University(新加坡国立大学)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.AI

AI总结 本文从决策视角出发,对基于LLM的世界模型进行综合评估,设计了政策验证、行动提案和政策规划三项任务,评估了GPT-4o和GPT-4o-mini在不同环境中的表现,发现LLM世界模型在长期决策任务中性能下降,且不同功能组合会引入额外的不稳定性。

Comments Accepted to TMLR

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19138 2026-03-20 cs.AI cs.CR cs.SE 57%

Implicit Patterns in LLM-Based Binary Analysis

基于LLM的二进制分析中的隐式模式

Qiang Li, XiangRui Zhang, Haining Wang

机构 * Beijing Jiaotong University(北京交通大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 研究揭示了基于LLM的多轮二进制漏洞分析中隐式形成的结构化模式,包括早期剪枝、路径依赖锁定、目标回溯和知识引导优先级,为构建更可靠的分析系统提供了基础。

Comments 18 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18627 2026-03-20 cs.AI 57%

Agentic Flow Steering and Parallel Rollout Search for Spatially Grounded Text-to-Image Generation

代理流引导与并行展开搜索用于空间感知的文本到图像生成

Ping Chen, Daoxuan Zhang, Xiangming Wang, Yungeng Liu, Haijin Zeng, Yongyong Chen

机构 * Harbin Institute of Technology(哈尔滨工业大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出AFS-Search框架,通过闭合环路机制和空间感知引导提升文本到图像生成的精度与效率,实现性能和速度的双重优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16137 2026-03-20 cs.CL 57%

SIA: A Synthesize-Inject-Align Framework for Knowledge-Grounded and Secure E-commerce Search LLMs with Industrial Deployment

SIA:一种用于知识引导和安全的电子商务搜索LLM的合成-注入-对齐框架

Zhouwei Zhai, Mengxiang Chen, Anmeng Zhang

机构 * Beijing China(中国北京)

专题命中 规划推理 :reasoning(abstract);分类 cs.CL

AI总结 本文提出SIA框架,通过合成高质量语料库、参数高效预训练和双路径对齐方法,解决电子商务搜索LLM的知识幻觉和安全漏洞问题,并在京东实现工业部署。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18489 2026-03-20 cs.CL 57%

EntropyCache: Decoded Token Entropy Guided KV Caching for Diffusion Language Models

EntropyCache: 基于解码令牌熵的KV缓存用于扩散语言模型

Minsoo Cheong, Donghyun Son, Woosang Lim, Sungjoo Yoo

机构 * Seoul National University(首尔国立大学)

专题命中 规划推理 :chain-of-thought(abstract);分类 cs.CL

AI总结 EntropyCache利用解码令牌熵指导KV缓存,通过最大熵信号决定是否重新计算,实现高效缓存更新,提升推理速度和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13647 2026-03-20 cs.IR cs.AI 57%

SF-RAG: Structure-Fidelity Retrieval-Augmented Generation for Academic Question Answering

SF-RAG:用于学术问答的结构保真检索增强生成

Rui Yu, Tianyi Wang, Ruixia Liu, Yinglong Wang

机构 * Qilu University of Technology (Shandong Academy of Sciences)(齐鲁工业大学(山东科学院)) National University of Singapore(新加坡国立大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 SF-RAG通过保留学术论文的层级结构,提高检索和生成的效率与准确性,减少碎片化并提升答案质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10971 2026-03-20 cs.CR cs.CL 57%

AJAR: Adaptive Jailbreak Architecture for Red-teaming

AJAR:适应性突破架构用于红队测试

Yipu Dou, Wang Yang

机构 * School of Cyber Science and Engineering(网络安全科学与工程学院)

专题命中 规划推理 :planning(abstract);分类 cs.CL

AI总结 AJAR框架通过可调用MCP服务实现多轮突破算法,提升X-Teaming攻击成功率至76.0%,并在工具访问下优化攻击面。

Comments 7 pages, 3 figures. Code and data available at https://github.com/douyipu/ajar

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16344 2026-03-20 cs.RO cs.AI 57%

Manual2Skill++: Connector-Aware General Robotic Assembly from Instruction Manuals via Vision-Language Models

Manual2Skill++: 通过视觉语言模型实现连接器感知的指令手册驱动机器人装配

Chenrui Tie, Shengxiang Sun, Yudi Lin, Yanbo Wang, Zhongrui Li, Zhouhan Zhong, Jinxuan Zhu, Yiman Pang, Haonan Chen, Junting Chen, Ruihai Wu, Lin Shao

机构 * School of Computing, National University of Singapore(新加坡国立大学计算机学院) University of Toronto(多伦多大学) Zhejiang University(浙江大学) Peking University(北京大学)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文提出Manual2Skill++框架,通过视觉语言模型从指令手册中提取结构化连接信息,构建层次化图表示,实现连接器为核心的装配任务理解与执行。

Journal ref ICRA2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.21475 2026-03-20 cs.AI 57%

MMSearch-Plus: Benchmarking Provenance-Aware Search for Multimodal Browsing Agents

MMSearch-Plus:面向多模态浏览代理的溯源感知基准测试

Xijia Tao, Yihua Teng, Xinxing Su, Xinyu Fu, Jihao Wu, Chaofan Tao, Ziru Liu, Haoli Bai, Rui Liu, Lingpeng Kong

机构 * The University of Hong Kong (HKU)(香港大学) Huawei Inc(华为公司)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 MMSearch-Plus是一个包含311个任务的基准测试,通过迭代图像-文本检索和交叉验证在噪声下强制多模态理解,提供模型无关的代理框架和集中标记模块,提升多步推理的鲁棒性。

Comments Project Page: https://mmsearch-plus.github.io

Journal ref ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10978 2026-03-20 cs.AI cs.CY 57%

Agentic LLM Framework for Adaptive Decision Discourse

代理大语言模型框架用于自适应决策 discourse

Antoine Dolant, Praveen Kumar

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出一种代理大语言模型框架,用于模拟决策 discourse,通过多方观点协作开发可行策略,解决复杂系统中的不确定性挑战,展示了两个案例研究,平衡了社会、经济和环境优先事项,为可扩展和情境感知的推荐奠定基础。

Comments 24 pages, 4 figures, 1 appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19228 2026-03-20 cs.CV 50%

SAMA: Factorized Semantic Anchoring and Motion Alignment for Instruction-Guided Video Editing

SAMA:用于指令引导视频编辑的因子化语义锚定与运动对齐

Xinyao Zhang, Wenkai Dong, Yuxin Song, Bo Fang, Qi Zhang, Jing Wang, Fan Chen, Hui Zhang, Haocheng Feng, Yu Lu, Hang Zhou, Chun Yuan, Jingdong Wang

机构 * Baidu(百度) Tsinghua University(清华大学) City University of Hong Kong(香港城市大学) Zhejiang University(浙江大学)

专题命中 规划推理 :planning(abstract)

AI总结 SAMA通过因子化语义锚定和运动对齐方法,在无需外部先验知识的情况下实现精确语义修改与运动保真的平衡,展示了强大的零样本视频编辑能力。

Comments 24 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19170 2026-03-20 cs.RO math.OC 50%

ADMM-Based Distributed MPC with Control Barrier Functions for Safe Multi-Robot Quadrupedal Locomotion

基于ADMM的分布式MPC与控制屏障函数用于安全多机器人四足运动

Yicheng Zeng, Ruturaj S. Sambhus, Basit Muhammad Imran, Jeeseop Kim, Vittorio Pastore, Kaveh Akbari Hamed

机构 * Department of Mechanical Engineering, Virginia Tech(弗吉尼亚理工大学机械工程系) The University of Texas at El Paso(德克萨斯理工大学)

专题命中 规划推理 :planning(abstract)

AI总结 本文提出基于ADMM的去中心化MPC框架,结合控制屏障函数约束,用于多机器人腿部系统的安全轨迹规划。通过节点-边分割公式与共识约束,将全局问题分解为独立二次规划问题,实现高效去中心化优化,提升实时性与安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10965 2026-03-20 cs.CE 50%

Geospatial AI for Liquefaction Hazard and Impact Forecasting: A Demonstrative Study in the U.S. Pacific Northwest

地理空间AI用于液化危险和影响预测:美国太平洋西北地区示范研究

Morgan D. Sanger, Brett W. Maurer

专题命中 规划推理 :planning(abstract)

AI总结 本文利用地理空间AI模型预测美国华盛顿和俄勒冈州85个地震场景的液化危险,结合机器学习提升预测精度,并通过资产和基础设施脆弱性评估验证其应用价值。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11052 2026-03-20 cs.RO 50%

AdaptPNP: Integrating Prehensile and Non-Prehensile Skills for Adaptive Robotic Manipulation

AdaptPNP: 集成抓取与非抓取技能以实现适应性机器人操控

Jinxuan Zhu, Chenrui Tie, Xinyi Cao, Yuran Wang, Jingxiang Guo, Zixuan Chen, Haonan Chen, Junting Chen, Yangyu Xiao, Ruihai Wu, Lin Shao

机构 * School of Computing, National University of Singapore(新加坡国立大学计算机学院) RoboScience(机器人科学) East China Normal University(华东师范大学) Peking University(北京大学) Nanjing University(南京大学)

专题命中 规划推理 :planning(abstract)

AI总结 本文提出AdaptPNP框架,通过视觉-语言模型整合抓取与非抓取技能,实现复杂机器人操控任务的规划与执行。

Journal ref ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏