arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-08-07 至 2026-08-07 共收录 61 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 61 篇

2608.06113 2026-08-07 cs.SE 新提交 89%

DCAS: Decoupling CLI Agent Scaffolding to Internalize Planning across Scaffolds

DCAS:解耦CLI智能体脚手架以在脚手架间内化规划能力

Kishanthan Thangarajah, Boyuan Chen, Ahmed E. Hassan

专题命中 规划决策 :agent(title,abstract);planning(title,abstract);分类 cs.SE

AI总结 本文针对CLI智能体微调后跨脚手架性能下降问题,提出DCAS框架,通过解耦脚手架与后端实现跨脚手架评估,微调规划感知轨迹后模型在非训练脚手架下性能一致提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23960 2026-08-07 cs.RO 版本更新 87%

Multi-Robot Motions in Milliseconds: Vector-Accelerated Primitives for Sampling-Based Planning

毫秒级多机器人运动:基于向量加速的采样规划原语

James D. Motes, Marco Morales, Nancy M. Amato

机构 * Parasol Lab, School of Computing and Data Science, University of Illinois at Urbana Champaign(帕索尔实验室,计算与数据科学学院,伊利诺伊大学厄巴纳-香槟分校) Department of Computer Science at Instituto Tecnológico Autónomo de México (ITAM)(墨西哥自治理工学院(ITAM)计算机科学系)

专题命中 规划决策 :planning(title,summary_cn)

AI总结 本文扩展了Vector-Accelerated Motion Planning框架,开发了多机器人MotionValidation和FindFirstConflict原语,利用SIMD并行性实现多机器人运动规划的高效验证与冲突检测,显著提升规划效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06346 2026-08-07 cs.AI 新提交 85%

TRAJDEBUG: Tracing Error Lifecycle to Identify Critical Failures in Long-Horizon Agent Trajectories

TRAJDEBUG:追踪错误生命周期以识别长视野智能体轨迹中的关键失败

Yunjia Qi, Zehua Yin, Xintong Shi, Hao Peng, Songyuanyi Lu, Yixian Liu, Richeng Xuan, Yuhong Liu, Zhichao Hu, Xiaozhi Wang, Lei Hou, Bin Xu, Juanzi Li

机构 * Tsinghua University(清华大学) Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Tencent Hunyuan(腾讯混元)

专题命中 规划决策 :agent(title,abstract);tool-use(abstract);agentic(abstract);分类 cs.AI

AI总结 针对长视野智能体轨迹调试的级联错误与关键错误定位难题,提出TrajDebug框架,构建含486条轨迹的TrajErrBench基准,实验显示其性能优于现有基线,可提供改进智能体的可操作反馈。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06197 2026-08-07 cs.AI 新提交 85%

EnvACE: Internalizing Environment Dynamics via World Rehearsal for Agentic Reinforcement Learning

EnvACE:通过世界预演内化环境动态以实现智能体强化学习

Zishan Xu, Zhiyuan Yao, Yuxin Chen, Yifu Guo, Zhengxi Lu, Yuquan Lu, Jinyang Huang, Yan Xu, Yasheng Wang, Weinan Zhang, Xingshan Zeng, Weiwen Liu

机构 * Shanghai Jiao Tong University(上海交通大学) Zhejiang University(浙江大学) National University of Singapore(新加坡国立大学) Sun Yat-sen University(中山大学) Central South University(中南大学) The Chinese University of Hong Kong(香港中文大学) Tencent Inc.(腾讯公司)

专题命中 规划决策 :agentic(title,abstract);agent(abstract);tool use(abstract);分类 cs.AI

AI总结 本文提出 EnvACE 方法,以世界预演替代外部环境交互训练 LLM 智能体,在多基准测试中性能优于基线,可突破外部环境约束扩展 LLM 智能体训练。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02721 2026-08-07 cs.AI 版本更新 85%

GrandCode: Achieving Grandmaster Level in Competitive Programming via Agentic Reinforcement Learning

GrandCode: 通过代理强化学习实现竞技编程的Grandmaster级别

Ornith Team, Xiaoya Li, Guoyin Wang, Songqiao Su, Chris Shum, Jiwei Li

机构 * DeepReinforce Team(DeepReinforce 团队)

专题命中 规划决策 :agentic(title,abstract);agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文提出GrandCode,一种用于竞技编程的多代理强化学习系统,通过代理模块协同训练和代理GRPO算法,实现了在竞技编程比赛中超越人类选手的突破。

Comments Tech Report; Pre-print

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05499 2026-08-07 cs.CV cs.AI cs.LG 新提交 84%

APQF: Agentic Profiling-Guided Structured Pruning and Mixed-Precision Quantization with Adaptive Fine-Tuning

APQF:基于智能体分析引导的结构化剪枝与混合精度量化及自适应微调

Sadegh Jafari, Mohiuddin Bilwal, Fan Zhou, Brian Gelder, Ali Jannesari

机构 * Iowa State University(爱荷华州立大学)

专题命中 规划决策 :agentic(title,abstract);agent(abstract);分类 cs.AI、cs.LG

AI总结 APQF是结合LLM引导与分析支撑的自动化剪枝量化框架,在ImageNet等数据集上实现高压缩比且精度接近基线,优于现有联合剪枝量化方法。

Comments 22 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05248 2026-08-07 cs.AI cs.CV 新提交 83%

WorldClaw: Agentic 3D Open-World Generation at Scale

WorldClaw:大规模智能体驱动的3D开放世界生成

Chunchao Guo, Jinpeng Li, Yang Li, Zilong Huang

专题命中 规划决策 :agentic(title,abstract);planning(abstract);分类 cs.AI

AI总结 WorldClaw是一种完全智能体驱动的由粗到细框架,可从开放式文本生成兼具全局空间一致性、丰富局部内容与可编辑实例级资产的大规模3D开放世界场景。

Comments Authors are listed in alphabetical order by given name

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24235 2026-08-07 cs.AI 版本更新 83%

SP-Mind: An Autonomous Reasoning Agent for Spatial Proteomics Analysis

SP-Mind: 用于空间蛋白质组学分析的自主推理智能体

Yucheng Yuan, Yuanfeng Ji, Zhongxiao Li, Ruijiang Li

机构 * Department of Computer Science, Stanford University, Stanford, USA(计算机科学系,斯坦福大学,斯坦福,美国) Department of Radiation Oncology, Stanford University, Stanford, USA(放射肿瘤学系,斯坦福大学,斯坦福,美国)

专题命中 规划决策 :agent(title,abstract);AI agent(abstract);分类 cs.AI

AI总结 提出首个自主AI智能体SP-Mind,统一空间蛋白质组学分析流程,通过自然语言查询实现端到端分析,在SP-Bench基准上达到最优性能。

Comments 24 pages, 6 figures. Accepted to ICML 2026. Equal contribution by Yucheng Yuan and Yuanfeng Ji

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05757 2026-08-07 cs.CV 新提交 82%

Beyond Relevance: Bayesian Evidence Acquisition for Agentic Whole-Slide Image Reasoning

超越相关性:面向智能体的全切片图像推理的贝叶斯证据获取

Bryan Wong, Xun Xu, Huazhu Fu, Nancy F. Chen, Mun Yong Yi

机构 * A*STAR(新加坡科技研究局)

专题命中 规划决策 :agentic(title,abstract);agent(abstract)

AI总结 本研究提出BEACON框架,将WSI推理建模为贝叶斯证据获取问题,通过最大化预期信息增益减少诊断不确定性,在五个WSI-VQA基准的零样本实验中,其性能优于同类无训练智能体框架,提升了证据获取效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04872 2026-08-07 cs.CL cs.AI cs.LG 版本更新 82%

A-SR: Self-Evolving Agentic LLMs for Symbolic Regression via Hierarchical Coordination

A-SR:通过分层协调实现符号回归的自进化智能体大语言模型

Wenxiao Zhao, Dong Liu, Kaiyi Xu, Feng Liu, Zhen Zhao, Fei Ben, Shu Wang, Wenhao Li, Ying Nian Wu, Fenghua Ling, Haobo Li, Lei Bai

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 A-SR是一种自进化智能体框架,通过分层协调实现符号回归,在LLM-SRBench科学领域和真实世界任务上显著提升了符号回归的Acc@0.01和归一化均方误差指标。

Comments 18 pages, 8 figures, including appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05954 2026-08-07 cs.AI cs.CV cs.LG 新提交 81%

Training a Conditioned Video Game Agent on a VLM Annotated Dataset

基于VLM标注数据集训练条件化电子游戏智能体

Katrin Schmid, Iuri Frosio

专题命中 规划决策 :agent(title,abstract);分类 cs.AI、cs.LG

AI总结 该研究针对电子游戏强化学习中奖励获取、加权及稀疏性等问题,提出用VLM标注数据集,结合离线RL训练条件化智能体,并分析实验中的困难与局限。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05673 2026-08-07 cs.AI cs.CV cs.LG 新提交 81%

A Unified Framework for Trajectory Prediction with Explicit Planning and Reaction Decomposition

显式规划与反应分解的轨迹预测统一框架

Jiaheng Chen, Jiaxing Li, Tinghe Zhang, Chaopeng Guo

机构 * Software College, Northeastern University(东北大学软件学院)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.LG

AI总结 针对现有轨迹预测方法未充分区分社会影响功能角色的问题,提出INTraJ框架,将社会影响分解为规划与反应两阶段,在四个基准上实现性能提升,验证了阶段性社会建模的重要性。

Comments Accepted by ACM MM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05521 2026-08-07 cs.SE 新提交 79%

Reasoning from Traces: Divergence-Guided Agentic Repair of WebAssembly Discrepancies

从痕迹中推理:分歧引导的智能体修复WebAssembly差异

Liyan Huang, Kaicheng Wang, Weihang Wang

专题命中 规划决策 :agentic(title,abstract);分类 cs.SE

AI总结 本文提出WasmMend系统,通过差分痕迹分析定位Wasm与原生执行的分歧函数,引导LLM智能体生成补丁,在真实C/C++项目上修复率达70.0%,优于基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05332 2026-08-07 cs.DC cs.AI 新提交 79%

Hierarchical Server Architecture for Agentic Science

面向智能体科学的分层服务器架构

Vanessa Sochat, Daniel Milroy

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI

AI总结 针对智能体科学的资源调度需求,提出分层动态架构及软件,借助秘书智能体在云、边缘和HPC系统中发现资源,经模拟验证其协商准确率达87.71%,选择成本与传统策略相当,可支持Genesis Mission。

Comments 10 pages, 9 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05225 2026-08-07 cs.AI 新提交 79%

Project2Task: Graph-Guided Project-Level Planning for Autonomous Research

Project2Task:面向自主研究的图引导项目级规划

Huirui Xu, Runtao Xu, Shuo Ren, Jiajun Zhang

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 该研究提出Project2Task图引导项目级规划层,可将研究项目转化为感知依赖的边界任务,在基准测试中其任务组合质量优于基线,与AutoResearchClaw整合后提升了下游任务准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18519 2026-08-07 cs.RO cs.AI 版本更新 79%

As You Wish: Mission Planning with Formal Verification using LLMs in Precision Agriculture

如您所愿:利用LLM在精准农业中进行形式化验证的任务规划

Marcos Abel Zuzuárregui, Stefano Carpin

机构 * University of California, Merced(加州大学默塞德分校)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 针对自然语言歧义性,提出基于线性时序逻辑(LTL)反馈循环的LLM任务规划系统,通过双LLM分工实现规范生成与验证,提升精准农业任务规划的可靠性。

Journal ref Published in Proceedings of 2026 International Conference on Robotics and Automation (ICRA)

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.08211 2026-08-07 cs.RO cs.AI 版本更新 79%

Path Planning of Cleaning Robot with Reinforcement Learning

基于强化学习的清洁机器人路径规划

Woohyeon Moon, Bumgeun Park, Sarvar Hussain Nengroo, Taeyoung Kim, Dongsoo Har

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 针对现有清洁机器人路径规划模型环境适应性差的问题,提出结合PPO算法与多种技术的方法,经实验验证其训练性能、收敛速度及清洁性能均优于传统方法。

Comments 7 pages with 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06008 2026-08-07 cs.RO 新提交 78%

Adaptive-WAM: Quality-Guided Early-Exit Planning from Intermediate Video-Diffusion Features

Adaptive-WAM:基于质量引导的中间视频扩散特征早期退出规划

Sining Ang, Yuguang Yang, Yan Wang

专题命中 规划决策 :planning(title,abstract)

AI总结 Adaptive-WAM是基于Wan2.2-5B主干的质量感知多出口规划器,通过动态分配主干深度减少计算量,在NAVSIM、nuScenes等数据集上取得优异规划性能,延迟显著降低。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05718 2026-08-07 cs.CV 新提交 78%

Iterative Hybrid Discrete-Continuous Viewpoint Planning for UAV Photogrammetry

面向无人机摄影测量的迭代式混合离散-连续视点规划方法

Alan Grech, Daniel Pisani, Andre Grima, Carl James Debono, Saviour Formosa, Dylan Seychell

机构 * Stargate Studios Malta(马耳他星门工作室) University of Malta(马耳他大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 该研究针对无人机摄影测量的局部重建误差问题,提出迭代式混合离散-连续视点规划方法,通过CMA-ES优化生成平衡局部质量与全局鲁棒性的飞行路径,在合成场景上提升了重建精度与完整性。

Comments 6 pages, 3 figures, 2 tables. Accepted for publication at the 14th IEEE European Conference on Visual Information Processing (EUVIP 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05551 2026-08-07 cs.CE 新提交 78%

Variable-Horizon Workforce Demand Forecasting with an Aggregate Demand Constraint for Construction Workforce Planning

面向建筑劳动力规划的带总需求约束的变时域劳动力需求预测

Hanbyeol Park, Jaehyeon Heo, Taekhyun Park, Minseong Kim, Hyerim Bae

专题命中 规划决策 :planning(title,abstract)

AI总结 本研究针对建筑劳动力规划的变时域与总需求约束问题,提出CP-RAF模型,经现场数据验证,其在多场景下预测性能优于基准模型,适配建筑劳动力分配需求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05365 2026-08-07 cs.RO 新提交 78%

Unified Planning-Learning Framework for Robust UUV Navigation Under Partial Observability

部分可观测条件下用于自主水下航行器(UUV)鲁棒导航的统一规划-学习框架

Md Ether Deowan, Eleni Kelasidi

机构 * NTNU(挪威科技大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 该研究提出统一规划-学习框架,结合占用地图构建、规划与控制,通过行为树蒸馏等技术提升UUV在部分可观测动态水下环境的导航鲁棒性与安全性,经仿真验证优于基线方法。

Comments 8 pages, 6 figures. Accepted for presentation at the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026), Philadelphia, PA, USA

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06349 2026-08-07 math.OC cs.SY eess.SY 新提交 78%

The Benefits of an Integrated Approach for Stability-Constrained Power System Planning

稳定性约束电力系统规划的集成方法的优势

Gereon Recht, Benedikt Jahn, Oussama Alaya, Karl-Kiên Cao, Hendrik Lens

专题命中 规划决策 :planning(title,abstract)

AI总结 针对电力系统规划串行方法的缺陷,研究集成方法在发电、输电、储能扩容时同步考虑稳定措施的优势,发现其可降低系统成本,且网格式电池储能系统的两用选项更具优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03571 2026-08-07 cs.CV 版本更新 78%

Beyond Simply Environment Scaling: Designing Effective Environment Distributions for Multimodal Agent Learning

超越单纯的环境规模扩展:为多模态智能体学习设计有效的环境分布

Kejian Zhu, Zhuoran Jin, Dongqi Huang, Hongbang Yuan, Yupu Hao, Kang Liu, Jun Zhao

专题命中 规划决策 :agent(title,abstract)

AI总结 该研究针对多模态智能体学习中单纯扩展环境数量无效的问题,提出AES与HDC两种方法优化环境分布,提升了智能体训练效果。

Comments Code: https://github.com/GaryStack/Beyond-MMEnv-Scaling

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27625 2026-08-07 cs.RO cs.DC 版本更新 78%

P-ARC: Exploiting Subproblem Independence for Parallel Multi-Robot Motion Planning

P-ARC:利用子问题独立性实现并行多机器人运动规划

James D. Motes, Marco Morales, Nancy M. Amato

机构 * Parasol Lab, School of Computing and Data Science, University of Illinois at Urbana Champaign(伊利诺伊大学厄巴纳-香槟分校计算与数据科学学院Parasol实验室)

专题命中 规划决策 :planning(title,abstract)

AI总结 提出P-ARC并行算法,通过并行化ARC的三个阶段并采用OR并行多启动策略,在多机器人运动规划中实现近4倍加速。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05832 2026-08-07 cs.CL 新提交 77%

Enhancing Social Intelligence in LLMs with Hierarchical Reasoning and Utterance-Level Goal Rewarding

利用层级推理和话语级目标奖励增强大型语言模型的社交智能

Xiaofeng Wang, Kakam Chong, Shuai Xiao, DeXin Kong, Qingyuan Tian, Chen Ju, Xu Yan, Shuai Zhao, Fei Huang, Rui Wang, Shuguang Han, jufeng chen

机构 * Alibaba Group(阿里巴巴集团) Shanghai Jiao Tong University(上海交通大学)

专题命中 规划决策 :agent(abstract);planning(abstract);multi-agent(abstract);分类 cs.CL

AI总结 该研究针对LLMs社交互动不足的问题,提出TSR框架与LHRL-VGR算法,微调Qwen2.5-7B智能体后在SOTOPIA基准上超过GPT-4o基线7.32%,实现多智能体社交谈判的最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05703 2026-08-07 cs.CV 新提交 71%

StreamArena: Toward Continuous, Interactive, and Long-Horizon Agentic Streaming Video Understanding

StreamArena:面向连续、交互式且长视界的智能体流媒体视频理解

Xichen Zhang, Guankai Li, Yinghao Zhu, Shijian Wang, Sitong Wu, Shaozuo Yu, Meng Chu, Yuan Lu, Jiaya Jia

机构 * The Hong Kong University of Science and Technology(香港科技大学) Xiaohongshu Inc.(小红书公司) The University of Hong Kong(香港大学) The Chinese University of Hong Kong(香港中文大学)

专题命中 规划决策 :agentic(title)

AI总结 针对当前智能体流媒体视频理解评估的缺陷,提出StreamArena基准,设计StreamMind架构解决连续交互与长视界理解的张力,在四项能力上优于现有基线并降低延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22901 2026-08-07 math.AT 版本更新 71%

Motion Planning on One-Dimensional Peano Continua

一维皮亚诺连续统上的运动规划

Jeremy Brazas, Petar Pavesic

专题命中 规划决策 :planning(title)

AI总结 该研究将一维空间的Lusternik-Schnirelmann范畴与拓扑复杂度定义为闭滤过长度,依据皮亚诺连续统的野性秩刻画其数值,发现其可任意高,与一维CW复形结果形成对比。

Comments 22 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06227 2026-08-07 cs.NI cs.AI cs.IT cs.SY eess.SY math.IT 新提交 70%

From Passive Mirrors to Active Agents: Holonic Digital Twins for Physical AI over Networks

从被动镜像到主动智能体:面向网络物理AI的 holonic 数字孪生

Christo Kurisummoottil Thomas, Omar Hashash, Walid Saad

专题命中 规划决策 :agent(abstract);planning(abstract);分类 cs.AI

AI总结 本文针对当前AI嵌入物理系统失效、无线网络架构无法支持实时物理AI协调的问题,提出HDT-Nets框架,通过holonic数字孪生实现实时物理AI推理,为网络物理AI提供新方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05806 2026-08-07 cs.CL cs.AI 新提交 62%

Hierarchical Latent Prediction for Language Models

语言模型的分层隐式预测

Chang Shi, Tim Pearce, Manan Tomar, Siddhartha Sen, John Langford

机构 * University of Texas at Austin(得克萨斯大学奥斯汀分校) Microsoft Research(微软研究院)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.CL

AI总结 该研究针对语言模型下一个token预测的误差累积问题,提出分层隐式预测方法,在编码、多步推理基准及推测解码上验证了其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05446 2026-08-07 cs.LG cs.CL 新提交 62%

EvoHarness-RL: Learning Self-Evolving Runtime Harness for Long-Horizon LLM Agents

EvoHarness-RL:为长视野大语言模型智能体学习自进化运行时管控器

Xuying Ning, Dongqi Fu, Tianxin Wei, Hanqing Zeng, Yuanchen Bei, Bingxuan Li, Zihao Li, Qifan Wang, Xiang Shen, Yifan Wu, Jiayi Liu, Hong Li, Yinglong Xia, Xiangjun Fan, Hanghang Tong, Jingrui He

机构 * University of Illinois Urbana–Champaign(伊利诺伊大学厄巴纳-香槟分校) Meta AI

专题命中 规划决策 :agent(abstract);分类 cs.CL、cs.LG

AI总结 本研究提出 EvoHarness-RL 方法,通过学习管控器策略解决长视野 LLM 智能体的外部状态管理问题,在 ALFWorld 上达到 96.9% 的任务成功率,验证了可训练管控器策略的有效性。

Comments Accepted to LLA@COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏