arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-08-05 至 2026-08-05 共收录 52 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 52 篇

2608.02582 2026-08-05 cs.SE 版本更新 89%

ACEM: A Cost Estimation Model for Agentic Software Engineering

ACEM:面向智能体软件工程的成本估算模型

Mohammad El-Ramly

专题命中 规划决策 :agentic(title,abstract);agent(abstract);AI agent(abstract);planning(abstract)

AI总结 针对智能体软件工程成本估算问题,本文提出ACEM模型,分解成本为LLM、HITL、基础设施三类,引入RF、CF、HIS构念并映射传统度量,为智能体开发成本估算提供早期方案。

Comments 27 pages, under journal publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11844 2026-08-05 cs.CV 版本更新 88%

Beyond the Single Camera: Agentic Multi-View Reasoning in Sports Video Understanding

超越单摄像头:体育视频理解中的智能多视角推理

Kerui Chen, Jinglu Wang, Xiaoyi Zhang, Yan Lu

机构 * Zhejiang University(浙江大学) Microsoft Research Asia(微软亚洲研究院)

专题命中 规划决策 :agent(summary_cn,abstract);agentic(title,abstract)

AI总结 针对体育视频多视角理解缺乏评估基准及MLLMs难以利用多视角信息的问题,引入SportMV - Bench基准,分析瓶颈所在,并提出SportMV - Agent框架,通过迭代循环实现主动视角选择等,相比最强MLLM基线有显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02876 2026-08-05 cs.AI 新提交 88%

BAP-SQL: Budget-Aware Observation Planning for Agentic Text-to-SQL

BAP-SQL:面向智能体Text-to-SQL的预算感知观测规划

Chong Peng, Pin Qian, Su Wang, Yihang Chen, Varun Sah

机构 * Microsoft(微软公司) Carnegie Mellon University(卡内基梅隆大学) Georgia Institute of Technology(佐治亚理工学院)

专题命中 规划决策 :planning(title,abstract);agentic(title,abstract);分类 cs.AI

AI总结 BAP-SQL是面向智能体Text-to-SQL的预算感知观测规划方法,通过将观测形成作为预算控制阶段,在紧预算下提升了SQL生成成功率,同时减少了token使用量。

Comments 10 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03009 2026-08-05 cs.CR 新提交 87%

Tiny Enough to Break In: Agentic Remote Access Trojans Powered by Small Language Models

小到足以突破:由小型语言模型驱动的智能体远程访问木马

Yuhan You, Suhas Adavelly, Victoria Lovelace, Cameron Berryman, Joel Sadler, Daniel Graham

专题命中 规划决策 :agentic(title,summary_cn)

AI总结 该研究提出由小型语言模型(SLM)驱动的智能体远程访问木马(agentic RAT),经实验验证其架构可行,虽操作可靠性不足,但预示着AI驱动自主网络威胁的近现实风险。

Comments 6 pages, 5 figures, 1 table. Formatted in Springer LNCS style

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02764 2026-08-05 cs.MA cs.DB 新提交 87%

Stateful Governance for Concurrent Agentic Systems

并发智能体系统的有状态治理

Yuxiang Peng, Xiaodi Wu

专题命中 规划决策 :agentic(title,abstract);agent(abstract);AI agent(abstract);workflow(abstract)

AI总结 本文针对并发智能体系统的有状态治理问题,提出Provenact运行时架构,可防止失效授权,在采购工作流中避免策略违规,为智能体框架的有状态治理提供了可行路径。

Comments 18 pages, 8 figures. Revision notes: system terminology updated; technical content and results unchanged

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03468 2026-08-05 cs.AI 新提交 85%

ToolLIFT: Lifting Tool-Specific Trajectories into Function-Level Graphs for Generalizable Tool Planning

ToolLIFT:将工具特定轨迹提升为函数级图以实现可泛化的工具规划

Xiuhui You, Jiayi Luo, Zichao Shen, Qingyun Sun, Ziwei Zhang

专题命中 规划决策 :planning(title,abstract);tool-use(abstract);workflow(abstract);分类 cs.AI

AI总结 本文提出ToolLIFT框架,通过将工具特定轨迹提升为函数级工作流图,实现了更具泛化性的工具规划,在多个基准上优于现有方法,对未见过的工具集泛化能力强。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28942 2026-08-05 cs.AI 版本更新 85%

NeSyFS: A Neuro-symbolic Fast-Slow Thinking Framework for LLM Agent under Partial Observability

NeSyFS:部分可观测场景下LLM智能体的神经符号快慢思考框架

Duo Xu, Faramarz Fekri

专题命中 规划决策 :agent(title,abstract);autonomous agent(abstract);planning(abstract);分类 cs.AI

AI总结 该研究针对部分可观测场景下LLM智能体的决策挑战,提出NeSyFS神经符号快慢思考框架,结合知识图谱、TSMC算法与反思模块,在三个基准测试中表现优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03034 2026-08-05 cs.RO cs.AI 新提交 83%

PACE: Adaptive Budget Allocation for Time-Efficient Embodied Planning

PACE:面向时间高效具身规划的自适应预算分配

Yuchen Huang, Xijiang Ying, Zhenhua Ma, Xiaxiang Yuan, Zhijie Gao, Jiayi Huang, Ruichi Mao, Jiazheng Zhang, Hongsheng Ti, Maotao Tian, Rong Shi, Lu Zhao, Shizhuang Zhang, Zhuo Cui, He Wang, Ling Liu, Wei Zhang

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 PACE框架通过交错式思考-执行架构和动态预算分配器,在Robotouille基准测试中较ReAct+Think基线提升规划成功率,同时大幅减少推理时间,实现具身规划的时间效率与质量同步提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02011 2026-08-05 cs.AI 版本更新 83%

Before Reasoning Can Fail: Pre-Evidence Procedural Failures in Agentic RAG

在推理失效之前:智能体检索增强生成(RAG)中的证据前程序失效

Daeyoung Roh, Donghee Han

机构 * KAIST(韩国科学技术院)

专题命中 规划决策 :agentic(title,abstract);agent(abstract);分类 cs.AI

AI总结 该研究针对智能体RAG系统在推理前的程序失效,提出将错误答案分为两类失效,评估Read-Gate机制,发现强制阅读可提升准确率,且证据收集应作为独立轨迹控制问题评估。

Comments 22 pages, 7 figures. Code: https://github.com/Noverse0/before-reasoning-fails

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03502 2026-08-05 cs.AI cs.LG cs.MA 新提交 82%

Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks

用于复杂序列决策任务的混合大语言模型增强强化学习智能体

Christophe D. Hounwanou, John Emeka Eze, Yaé Ulrich Gaba

专题命中 规划决策 :agent(abstract);autonomous agent(abstract);tool-use(abstract);planning(abstract)

AI总结 本文提出混合LLM增强RL智能体,融合LLM规划与RL动作优化,经实验验证其在序列决策任务上优于仅RL、仅LLM的基线方法,为构建更强自主系统提供了新方向。

Comments 16 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03924 2026-08-05 cs.RO 新提交 82%

ETA: A New Agentic Paradigm for Embodied Tasks

ETA:一种用于具身任务的新型智能体范式

Yitong Chen, Zezheng Huai, Sixian Li, Yubang Wang, Haozhe Zhang, Yifei Zhang, Hechang Chen, Jingjing Gong, Yu-Gang Jiang, Xipeng Qiu

专题命中 规划决策 :agentic(title);agent(abstract,abstract_cn)

AI总结 针对当前具身系统泛化依赖训练数据、长时执行难控的问题,提出新型具身任务智能体范式ETA,发布开源实现OpenETA,为Codex提供轻量级插件以支持具身任务处理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03223 2026-08-05 cs.LG cs.AI cs.CL 新提交 82%

Agentic Reinforcement Learning with Self-Distilled Reward Shaping

具有自提炼奖励塑造的智能体强化学习

Ranxu Zhang, Guinan Chen, Chenshaodong, Jinghao Lin, Xiaozhou Xu, Sunzhe, Yanyong Zhang, Chao Wang

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 针对智能体强化学习中稀疏奖励无法分配中间决策信用的问题,提出ADRS框架,通过校准教师分数等提升多轮语言智能体在长时域任务的性能,且增益稳定。

Comments 17 pages,10 figures,11 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20144 2026-08-05 cs.DB 版本更新 82%

An Agentic Approach to Metadata Reasoning

元数据推理的代理方法

Jiani Zhang, Sercan O. Arik, Cosmin Arad, Fatma Ozcan, Alon Halevy

专题命中 规划决策 :agentic(title,abstract);autonomous agent(abstract)

AI总结 本文提出元数据推理代理,通过检索候选表和自主咨询元数据,有效筛选数据源。在KramaBench和合成基准测试中,其在数据选择和避免低质量数据方面表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03958 2026-08-05 cs.AI 新提交 81%

A game theory for foundation models shows new paths to rational cooperation through similarity inference

基础模型的博弈论:通过相似性推理实现理性合作的新路径

Alexander Meulemans, Maciej Wołczyk, Marissa A. Weis, Rajai Nasser, Roberta Rocca, Seijin Kobayashi, Guillaume Lajoie, Angelika Steger, Blake Richards, Marcus Hutter, James Manyika, Rif A. Saurous, João Sacramento, Blaise Agüera y Arcas

专题命中 规划决策 :agent(abstract);AI agent(abstract);autonomous agent(abstract);planning(abstract)

AI总结 本文提出针对基础模型智能体的嵌入贝叶斯智能体理论模型,通过嵌入均衡机制实现相似性推理,破解经典博弈论预测的社会困境中相互背叛问题,达成稳定合作。

Comments 75 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01269 2026-08-05 cs.CL cs.AI 版本更新 81%

ACE-GraphRAG: Agentic Context Engineering for Hierarchical GraphRAG

ACE-GraphRAG:面向分层GraphRAG的智能体上下文工程

Yongfeng Huang, Yuren Lai, Ruiying Chen, Haoyu Huang, Mingming Zhao, James Cheng

机构 * The Chinese University of Hong Kong(香港中文大学) Wuhan University of Technology(武汉理工大学) The Hong Kong University of Science and Technology(香港科技大学) Huawei Noah’s Ark Lab(华为诺亚方舟实验室)

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI、cs.CL

AI总结 ACE-GraphRAG针对分层GraphRAG的表示-推理差距,提出两种自适应上下文策略,在多任务基准上优于现有RAG和GraphRAG基线,验证了动态上下文构建策略的有效性。

Comments Withdrawn because the manuscript was posted prematurely before completion of the required internal review and release authorization

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03086 2026-08-05 eess.IV cs.LG 新提交 79%

Automatic Patient-Specific Microwave Ablation Planning Accelerated by a Physics-Guided Deep Learning Model

基于物理引导深度学习模型加速的患者特异性微波消融自动规划

Seonaeng Cho, Minjee Seo, Minju Seol, Juil Park, Joon Ho Kwon, Kyungho Yoon

专题命中 规划决策 :planning(title,abstract);分类 cs.LG

AI总结 该研究提出结合神经消融预测模型与遗传算法的数字孪生框架,可快速实现患者特异性微波消融自动规划,提升消融效率、减少器官损伤且规划速度快约420倍

Comments Accepted at the Digital Twin for Healthcare (DT4H 2026) workshop at MICCAI 2026; 10 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03784 2026-08-05 cs.CE 新提交 78%

Empirical behavioural heterogeneity shapes the dynamics of an agent-based land use model

经验行为异质性塑造基于智能体的土地利用模型的动态特征

Ronja Hotz, Thomas Schmitt, Calum Brown, Yongchao Zeng, Mark Rounsevell

专题命中 规划决策 :agent(title,abstract)

AI总结 该研究将欧洲林业从业者的经验行为类型学整合进基于智能体的土地利用模型,发现行为异质性可削弱土地利用的同步响应,提升模型真实性,且个体决策行为依赖所处种群环境。

Comments 30 pages, 24 figures. Submitted to SESMO

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03408 2026-08-05 cs.RO cs.DC 新提交 78%

Flying over The Uncertain Nature (FORTUNE): Intelligent and Humanistic 3D Path Planning for Low-Altitude Collaboration

飞越不确定性自然(FORTUNE):面向低空协同的智能且人文的三维路径规划

Minghui Liwang, Wenhan Jia, Xinlei Yi, Wenbo Zhu, Yuhan Su, Xianbin Wang

专题命中 规划决策 :planning(title,abstract)

AI总结 本文针对低空智能体的三维多无人机路径规划问题,提出FORTUNE分层离线-在线框架,其在真实与合成场景中性能优于现有最优方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17422 2026-08-05 cs.NI 版本更新 78%

LATTICE: Constraint-Directed Scheduling, Memory Planning, and Pipeline Refinement for NPUs

DAN调度器:通用NPUs调度、内存布局和流水线重叠的确定性三阶段协同优化

Runhao Liu, Minnan Pei, Fei Ding, Guangzhen Yao, You Li, Peng Xiao, Gang Li, Peng Zhang

专题命中 规划决策 :planning(title,abstract)

AI总结 研究针对通用NPUs,提出DAN-Scheduler框架,通过内存压力感知拓扑调度、确定性线性重新打包、关键路径增强三个阶段协同优化调度、内存布局和流水线重叠,在六个运算符级DAG上评估,相比基线有显著性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.19209 2026-08-05 cs.RO cs.MA 版本更新 78%

Graph Neural Planning and Predictive Control for Multi-Robot Communication-Constrained Unlabeled Motion Planning

基于图神经网络的多机器人通信受限的无标签运动规划与预测控制

Manohari Goarin, Yang Zhou, Giuseppe Loianno

机构 * New York University(纽约大学) University of California Berkeley(加州大学伯克利分校)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出一种分层框架,结合图注意力规划器和分布式非线性模型预测控制器,以解决多机器人在通信受限环境下同时分配目标和生成安全轨迹的问题,通过图神经网络方法实现可扩展的去中心化解决方案。

Comments 8 pages, 6 figures, Accepted at the IEEE International Conference on Robotics and Automation (ICRA) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11140 2026-08-05 cs.SE cs.AI cs.CL cs.HC 版本更新 75%

Automated Visualization Code Synthesis via Multi-Path Reasoning and Feedback-Driven Optimization

通过多路径推理和反馈驱动优化实现自动化可视化代码合成

Wonduk Seo, Daye Kang, Hyunjin An, Taehan Kim, Soohyuk Cho, Seungyong Lee, Minhyeong Yu, Jian Park, Yi Bu, Seunghyun Lee

机构 * AI Research, Enhans, Seoul, South Korea Innovation \& Technology, KAIST, Daejeon, South Korea Department of Computer Science, University of California, Berkeley, CA, United States Department of Electrical

专题命中 规划决策 :agent(abstract,abstract_cn);分类 cs.AI、cs.CL、cs.SE

AI总结 VisPath通过多路径推理和反馈驱动优化,提升自动化可视化代码生成的可靠性与准确性。

Comments Accepted by International Conference on Pattern Recognization (ICPR 2026)

Journal ref Pattern Recognition. ICPR 2026. Lecture Notes in Computer Science, vol 16812. Springer, Cham

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00485 2026-08-05 cs.CL 版本更新 74%

SERL-SQL: Selective Hindsight Distillation for Text-to-SQL Reinforcement Agentic Learning

SERL-SQL:面向Text-to-SQL强化智能体学习的选择性回溯蒸馏

Tao Liu, Tao Feng, Xiangheng Li, Jinwang Song, Yifan Li, Xiaoqing Cheng, Dixuan Zhang, Siquan Li, Lin Lan, Hongying Zan, Kunli Zhang, Chao Wu

专题命中 规划决策 :agentic(title);分类 cs.CL

AI总结 该研究针对现有Text-to-SQL强化学习方法奖励指导不足的问题,提出SERL-SQL框架,通过教师模型重评分与掩码权重优化GRPO优势,在BIRD、Spider等基准上取得优异执行准确率,其奖励选择策略表现优于一致性选择。

Comments 9 pages,6 figures, Underreview

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03882 2026-08-05 cs.CL cs.AI cs.IR 新提交 73%

MultiGlobeQA: A Multilingual and Globally Diverse Benchmark for Geospatial Reasoning

MultiGlobeQA:面向地理空间推理的多语言且全球多样化基准

Martin Böckling, Elizaveta Nosova, Heiko Paulheim, Andreea Iana

专题命中 规划决策 :tool use(abstract);agentic(abstract);分类 cs.AI、cs.CL

AI总结 MultiGlobeQA是覆盖201个国家地区的多语言地理空间推理基准,含46060个问答对,实验发现LLMs在网格索引等任务上表现差,计算是瓶颈且低收入地区表现差距大。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03138 2026-08-05 cs.CL cs.AI 新提交 73%

Internalizing Academic Writing Workflows for Introduction Generation via Struct-Aware Policy Learning

通过结构感知策略学习内化学术写作工作流以生成引言

Meicong Zhang, Tiancheng Su, Jiahao Cheng, Guoxiu He, Xinqi Tao, Dejia Song

专题命中 规划决策 :agent(abstract);workflow(abstract);分类 cs.AI、cs.CL

AI总结 该研究针对LLM生成论文引言的挑战,提出StructPO框架将多阶段写作工作流内化为单遍策略,实验显示其在语义对齐等指标上优于基线,泛化性好且与GPT-5.1性能相当。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13888 2026-08-05 cs.RO 版本更新 71%

Path-conditioned Reinforcement Learning-based Local Planning for Long-Range Navigation

基于路径条件的强化学习局部规划用于远距离导航

Mateo Haro, Julia Richter, Fan Yang, Cesar Cadena, Marco Hutter

专题命中 规划决策 :planning(title)

AI总结 本文提出一种基于强化学习的局部导航策略,利用路径信息作为上下文指导,提升远距离导航效率并保持在路径信息退化时的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03606 2026-08-05 cs.AI cs.LG 新提交 66%

Learning Clinical-Trial Strategy: Offline Policy Training for Decision Agents

临床试验策略学习:面向决策智能体的离线策略训练

William Bolton, Philip Torr

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.LG;agentic(comments)

AI总结 本研究将肿瘤学临床开发建模为离线决策问题,构建时间数据集,对比4种离线目标与4种LLM智能体,发现奖励加权行为克隆表现最优,证明结构化离线学习可用于规划临床实验。

Comments Accepted for a spotlight at the ICML 2026 Workshop on Generative and Agentic AI for Biology (GenBio) and as a poster at the ICML 2026 Workshop on Decision-Making from Offline Datasets to Online Adaptation: Black-Box Optimization to Reinforcement Learning (DEMO). 15 pages, 3 figures, 11 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04007 2026-08-05 cs.CL cs.AI 新提交 62%

TurnSight: Turn-Level Hindsight Self-Distillation for Tool-Integrated Reasoning

TurnSight:面向工具集成推理的回合级事后自蒸馏方法

Changle Qu, Sunhao Dai, Hengyi Cai, Yuqi Zhou, Xinran Chen, Simon, Jun Xu

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.CL

AI总结 针对工具集成推理中现有方法缺乏细粒度监督的问题,提出TurnSight框架,通过回合级事后自蒸馏生成可靠监督信号,在三个基准上验证了其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03087 2026-08-05 cs.LG cs.AI 新提交 62%

SynEnergy: Anomaly Semantic-Guided Diffusion for Synthetic Energy Data Generation

SynEnergy:面向合成能源数据生成的异常语义引导扩散模型

Lin Jiang, Dahai Yu, Ravikumar Gelli, Guang Wang

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出SynEnergy,一种两阶段扩散框架,通过HG-ASL提取异常语义、AS-Diff生成数据,在四个真实能源数据集上较11种基线提升异常保留与下游质量,可扩展至城市级场景。

Comments 24 pages, 44 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02826 2026-08-05 quant-ph cs.AI cs.LG stat.ML 新提交 62%

Improved Quantum Algorithms for Reinforcement Learning Under a Generative Model

生成模型下强化学习的改进量子算法

Joao F. Doriguello

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.LG

AI总结 本研究针对两类马尔可夫决策过程,提出结合值迭代与量子子例程的新型量子强化学习算法,其查询复杂度优于现有成果,接近量子下界。

Comments 22 pages. Comments welcome

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03114 2026-08-05 econ.TH cs.AI cs.CY 新提交 57%

Optimal Liability Design for Medical AI

医疗人工智能的最优责任设计

Rui Mao, Tingliang Huang, Houcai Shen

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 本文构建委托代理模型研究医疗AI的最优责任设计,发现不对称信息下最优责任为统一水平,AI准确度与最优责任呈非单调关系,信息不对称是双刃剑,透明度对各利益相关者影响不均。

详情

展开后加载摘要…

URL PDF HTML 收藏