arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 35436 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 35436 篇

2607.24625 2026-07-28 cs.CR cs.AI 新提交 83%

Agentic Permissions Policy Algebra for Taint Confinement in LLM Agents

用于大语言模型代理中污点限制的代理权限策略代数

Arseny Kravchenko, Vadim Liventsev, Innokentii Konstantinov, Ildar Iskhakov, Matvey Kukuy

专题命中 规划决策 :agentic(title,abstract);agent(abstract);分类 cs.AI

AI总结 研究大语言模型代理处理混合机密数据时的安全风险,提出APPA框架,通过引擎管理上下文分支等解决可用性瓶颈,经双幺半群模型证明相关特性,实验表明其能抑制数据泄露并恢复部分被污点跟踪损失的效用。

Comments Preprint. Submitted to the 19th ACM Workshop on Artificial Intelligence and Security (AISec '26). 10 pages, 2 tables, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22947 2026-07-28 cs.AI cs.MA cs.NI cs.SC 新提交 83%

Let AI Agents Translate Networks, Not Reason About Them

让人工智能代理翻译网络,而非对其进行推理

Hongyu Hè, Maria Apostolaki

机构 * Princeton University(普林斯顿大学)

专题命中 规划决策 :AI agent(title,abstract);agent(abstract);分类 cs.AI

AI总结 研究针对生产网络缺乏形式模型的问题,提出将人工智能局限于网络工件到形式逻辑规则的翻译,依靠求解器推理,构建TypoNet验证模拟广域网符号模型,能快速可靠回答操作问题及促进故障定位。

Comments 8 pages, 3 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22732 2026-07-28 cs.AI 新提交 83%

Spatial Reasoning in LLM Game Agents: Impact of Causal Context and Multi-Step Planning

大语言模型游戏智能体中的空间推理:因果上下文和多步规划的影响

Mohit Jiwatode, Ronja Fuchs, Robin Schmöcker, Bodo Rosenhahn, Alexander Dockhorn

专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.AI

AI总结 研究基于大语言模型的游戏智能体在复杂任务中表现不佳的问题,通过实验验证因果提示增强和多步规划可提升胜率并控制延迟,引入新基准评估,发现较大模型定位更准,融入因果上下文和多步规划能优化性能与速度。

Comments To be published at COG 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22445 2026-07-27 cs.AI cs.CR 新提交 83%

Dynamic Capability Scoping for Enterprise AI Agents: A Synthetic Dataset and Three-Source Permission Architecture

企业人工智能代理的动态能力范围界定:一个合成数据集和三源权限架构

Halil Burak Noyan

专题命中 规划决策 :AI agent(title,abstract);agent(abstract);分类 cs.AI

AI总结 研究企业人工智能代理动态能力范围界定问题,提出三源权限架构,包括基于角色的上限等,贡献含600个企业任务提示的合成数据集,经验证可推动策略优化,还发布相关内容支持对动态范围界定机制的评估。

Comments Published at the Second Workshop on Agents in the Wild: Safety, Security, and Beyond (AIWILD) at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22400 2026-07-27 cs.NI cs.AI 新提交 83%

A Self-Calibrating Agentic AI Framework for Autonomous Edge Resource Allocation

一种用于自主边缘资源分配的自校准智能体人工智能框架

Fin Gentzen, Marla Grunewald, Iulisloi Zacarias, Mounir Bensalem, Admela Jukan

专题命中 规划决策 :agentic(title,abstract);autonomous agent(abstract);分类 cs.AI

AI总结 针对大语言模型驱动系统运行可靠性受挑战的问题,提出自校准智能体人工智能框架,设计自校准机制,应用于边缘计算网络零知识工作负载资源分析,提高预测准确率和速度,为自主人工智能部署奠定基础,且生成基本事实速度更快。

Comments This work has been submitted to the IEEE Transactions on Network and Service Management for possible publication. Copyright may be transferred without notice, after which this version may no longer be accessible

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22166 2026-07-27 cs.RO cs.AI 新提交 83%

Learning Spatiotemporal Decision Priors for Efficient Path Planning under Partial Observability

学习时空决策先验以实现部分可观测性下的高效路径规划

Yi Liu, Hongda Zhang, Leyao Zou, Chunlei Meng, Ziqing Zhou, Yuning Chen, Zhuo Zou, Lida Xu, Zhongxue Gan, Chun Ouyang

机构 * College of Intelligent Robotics and Advanced Manufacturing, Fudan University(智能机器人与先进制造学院,复旦大学) School of Information Science and Technology, Fudan University(信息科学与技术学院,复旦大学) Department of Information Technology, Old Dominion University(信息技术系,老 Dominion 大学)

专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.AI

AI总结 研究部分可观测性下的路径规划问题,提出ImiPath框架,从示范轨迹提炼时空决策先验,经局部时空观测表示和时空注意力策略网络转换为决策先验并纳入异构规划器,提升路径质量与搜索效率,验证了框架的适应性和实际部署潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19595 2026-07-23 cs.CR cs.CL 新提交 83%

Twin Agent: Context Residual Compression for Privilege Separated Agents

孪生智能体:用于特权分离智能体的上下文残差压缩

Zhanhao Hu, Dennis Jacob, Xiao Huang, Zhaorun Chen, Bo Li, David Wagner

机构 * University of California, Berkeley(加州大学伯克利分校) University of Chicago(芝加哥大学) University of Illinois, Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 规划决策 :agent(title,abstract);tool use(abstract);分类 cs.CL

AI总结 针对大语言模型智能体易受安全风险问题,提出孪生智能体模式,由探索和安全智能体组成,通过探索智能体传递紧凑提示,减少信息需求,在保持高任务效用的同时防止提示注入攻击,优于其他基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16716 2026-07-21 cs.AI 新提交 83%

RECON: Benchmarking Agent Memory for Compositional Reasoning over Long Contexts

RECON:用于长上下文组合推理的智能体内存基准测试

Mihir Shriniwas Arya

机构 * RV College of Engineering(RV工程学院) Department of Computer Science and Engineering(计算机科学与工程系)

专题命中 规划决策 :agent(title,abstract);workflow(abstract);分类 cs.AI

AI总结 该研究引入RECON基准测试,用于评估长上下文组合推理,跨越三个领域24个案例文件,测试智能体六个内存密集型任务,揭示当前架构在内存相关任务上存在重大局限,非预言机系统准确率低,检索和推理有挑战。

Comments 25 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16421 2026-07-21 cs.AI 新提交 83%

When to Plan: Learning to Select Between Reactive Control and Deliberative Planning

何时进行规划:学习在反应式控制和审慎规划之间进行选择

Adam Labiosa, Josiah P. Hanna

专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.AI

AI总结 研究智能体如何学习元推理能力,引入基于反应式策略不确定性得分分配计算的强化学习方法训练元推理策略,通过实证研究表明该设计能让元推理策略学会何时采用反应式策略,何时进行决策时规划,且能随反应式策略改进转向完全反应式控制。

Comments RLC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03651 2026-07-20 cs.LG math.OC 版本更新 83%

LLM-Guided Transportation Hub Capacity Planning with Textual Business Inputs

基于文本业务输入的大语言模型引导的交通枢纽容量规划

Xiaoyue Liu, Zheng Dong

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.LG

AI总结 研究提出用大语言模型代理依自然语言业务描述迭代提出枢纽容量决策的框架,核心机制是思维链推理协议,经反馈回路验证决策,在实际货运网络中表现优于传统模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01244 2026-07-20 cs.CL 版本更新 83%

Large-Scale Terminal Agentic Trajectory Generation from Dockerized Environments

从Docker化环境生成大规模终端代理轨迹

Siwei Wu, Yizhi Li, Yuyang Song, Wei Zhang, Yang Wang, Riza Batista-Navarro, Xian Yang, Mingjie Tang, Bryan Dai, Jian Yang, Chenghua Lin

机构 * University of Manchester(曼彻斯特大学) IQuest Research(IQuest研究) Beihang University(北航大学) Sichuan University(四川大学) Multimodal Art Projection Research Community(多模态艺术投影研究社区)

专题命中 规划决策 :agentic(title,abstract);agent(abstract);分类 cs.CL

AI总结 本文提出TerminalTraj,通过Docker化环境生成高质量终端轨迹,提升代理模型在终端任务中的性能表现。

Comments Accepted as a Spotlight paper at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14777 2026-07-17 cs.CL 新提交 83%

SEED: Self-Evolving On-Policy Distillation for Agentic Reinforcement Learning

SEED:用于智能体强化学习的自进化在线策略蒸馏

Jinyang Wu, Shuo Yang, Zhengxi Lu, Fan Zhang, Yuhao Shen, Lang Feng, Haoran Luo, Zheng Lian, Shuai Zhang, Zhengqi Wen, Jianhua Tao

机构 * Tsinghua University(清华大学) Zhejiang University(浙江大学) The Chinese University of Hong Kong(香港中文大学) Nanyang Technological University(南洋理工大学) Tongji University(同济大学)

专题命中 规划决策 :agentic(title,abstract);tool use(abstract);分类 cs.CL

AI总结 研究针对基于结果的强化学习中间决策指导有限的问题,提出SEED框架。它将在线策略轨迹转化为训练技能并提炼回策略模型,通过微调策略生成技能,重新评分动作转化蒸馏信号,联合优化提升性能与样本效率及泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14658 2026-07-17 cs.AI 新提交 83%

TopoAgent: A Self-Evolving Topological Agent for Multimodal Scientific Reasoning

TopoAgent:用于多模态科学推理的自进化拓扑智能体

Mingze Xu, Yinghui Li, Jiayi Kuang, Zhanhui Kang, Di Yin, Ying Shen, Xing Sun, Yuxing Han

专题命中 规划决策 :agent(title,abstract);planning(abstract);分类 cs.AI

AI总结 研究针对多模态大语言模型科学推理难题,提出TopoAgent自进化拓扑框架,用图进化取代线性轨迹,通过前端分解器、DAG组织原子及自适应原子裂变实现,实验证明其显著优于线性智能体框架,为科学推理提供新范式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19729 2026-07-17 cs.RO cs.AI 版本更新 83%

VOiLA: Vectorized Online Planning with Learned Diffusion Models for POMDP Agents

VOiLA: 基于学习扩散模型的向量化在线规划用于POMDP智能体

Marcus Hoerger, Rishikesh Joshi, Rahul Shome, Ian Manchester, Hanna Kurniawati

机构 * Australian National University(澳大利亚国立大学) The University of Sydney(悉尼大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 提出VOiLA框架,利用条件扩散模型学习POMDP模型,通过蒸馏加速采样并与向量化在线规划器集成,在三个基准任务和实物机器人上实现高效在线规划。

Comments Submitted to the 2026 International Symposium of Robotics Research (ISRR)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10748 2026-07-14 cs.LG 新提交 83%

Policy-Driven CT-Agent: Modeling Phase-Aware Diagnostic Control for Clinically Consistent CT Reasoning

策略驱动的CT智能体:为临床一致的CT推理建模阶段感知诊断控制

Yanmeng Dong, Han Li, Yujia Li, Jingsong Liu, Xun Ma, Yanzhu Hu, Zhengyang Xu, Zhicheng Li, Nassir Navab, Shaohua Kevin Zhou

机构 * University of Science and Technology of China(中国科学技术大学) Technical University of Munich(慕尼黑工业大学)

专题命中 规划决策 :agent(title,abstract);planning(abstract);分类 cs.LG

AI总结 研究针对CT诊断阶段选择协议差异及现有方法局限,提出策略驱动的CT智能体(PD-CTAgent)。通过临床结构抽象模块和知识引导诊断控制模型,实现阶段感知诊断推理,实验验证其在多数据集上的有效性与临床一致性。

Comments 8 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30616 2026-07-14 cs.CL 版本更新 83%

Scaling the Horizon, Not the Parameters: Reaching Trillion-Parameter Performance with a 35B Agent

扩展视野而非参数:以35B智能体达到万亿参数性能

Lei Bai, Zongsheng Cao, Yang Chen, Zhiyao Cui, Shangheng Du, Yue Fan, Shiyang Feng, Zijie Guo, Haonan He, Liang He, Xiaohan He, Shuyue Hu, Yusong Hu, Songtao Huang, Yichen Jiang, Hao Li, Xin Li, Dahua Lin, Weihao Lin, Fenghua Ling, Dongrui Liu, Zhuo Liu, Wenjie Lou, Runmin Ma, Chunjiang Mu, Haoyang Peng, Tianshuo Peng, Jinxin Shi, Luohe Shi, Boyuan Sun, Zelin Tan, Shengji Tang, Yan Teng, Qianyi Wang, Xiaosong Wang, Yiming Wu, Yi Xie, Xiangchao Yan, Jingqi Ye, Peng Ye, Fangchen Yu, Jiakang Yuan, Bihao Zhan, Bo Zhang, Chen Zhang, Shufei Zhang, Shuaiyu Zhang, Wenlong Zhang, Yiqun Zhang, Junpeng Zhao, Zhijie Zhong, Bowen Zhou, Yuhao Zhou

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 规划决策 :agent(title,abstract);agentic(abstract);分类 cs.CL

AI总结 提出35B混合专家智能体模型Agents-A1,通过扩展智能体视野(长程轨迹与异构能力)达到万亿参数级别性能,采用三阶段训练(全领域微调、领域教师模型、多教师领域路由策略蒸馏)在多个长程基准上取得领先或竞争力结果。

Comments The model checkpoints and evaluation codebase are available at https://huggingface.co/collections/InternScience/agents-a1 and https://github.com/InternScience/Agents-A1

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05622 2026-07-10 cs.CL 版本更新 83%

AdaPlanBench: Evaluating Adaptive Planning in Large Language Model Agents under World and User Constraints

AdaPlanBench: 在世界约束和用户约束下评估大语言模型智能体的自适应规划能力

Jiayu Liu, Cheng Qian, Zhenhailong Wang, Bingxuan Li, Jiateng Liu, Qing Zong, Heng Wang, Jeonghwan Kim, Yumeng Wang, Bingxiang He, Xiusi Chen, Yi R. Fung, Heng Ji

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.CL

AI总结 针对现有基准未充分探索渐进揭示的双重约束下的自适应规划问题,提出动态交互基准AdaPlanBench,通过307个家务任务和可扩展的约束构建流程,评估LLM智能体在交互中根据反馈迭代调整计划的能力。

Comments COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07612 2026-07-09 cs.CY cs.AI 新提交 83%

Towards Agentic AI Governance: A Preliminary Assessment

迈向智能体人工智能治理:初步评估

Mubarak Raji, Masooda Bashir

机构 * School of Information Sciences, University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校信息科学学院)

专题命中 规划决策 :agentic(title,abstract);planning(abstract);分类 cs.AI

AI总结 本文针对智能体人工智能快速发展带来的新挑战,对其治理新兴文献做系统综述,分析其与传统系统不同的特征及治理需求,综合治理重点、机制和利益相关者角色,为制定指导智能体人工智能治理的路线图奠定基础。

Comments International Conference on the AI Revolution: Research, Ethics, and Society (AIR-RES 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06764 2026-07-09 cs.AI 新提交 83%

Cost-Effective Agent Harnesses for Abstract Reasoning and Generalization on ARC-AGI-1

用于ARC-AGI-1上抽象推理和泛化的经济高效智能体框架

Kabir Moghe, Peter Chin

机构 * Dartmouth College(达特茅斯学院)

专题命中 规划决策 :agent(title,abstract);agentic(abstract);分类 cs.AI

AI总结 研究ARC-AGI-1上在严格预算下非思考模式的开放权重模型,构建智能体框架,包括探索者-定义者管道和反思协调器,通过特定架构提升基线成绩,分析了管道特性,确定思考工具是重要组件。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06140 2026-07-08 cs.CL 新提交 83%

CurateEvo: Data-Curation Evolving for Agentic Post-Training

CurateEvo:用于智能体训练后的数据管理进化

Dingzirui Wang, Xuanliang Zhang, Keyan Xu, Qingfu Zhu, Wanxiang Che

专题命中 规划决策 :agentic(title,abstract);agent(abstract);分类 cs.CL

AI总结 研究针对大语言模型智能体训练后决策问题,提出CurateEvo框架,将数据管理策略表示为代码并迭代重写。通过诊断故障模式增强、过滤数据提高有效性,在成本感知下修剪训练轮次提高效率,实验证明其性能优于现有方法且降低管理开销。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05377 2026-07-07 cs.RO cs.AI cs.CV 新提交 83%

Cortex: A Bidirectionally Aligned Embodied Agent Framework for Long-horizon Manipulation

Cortex:一种用于长视距操作的双向对齐具身智能体框架

Jiaqi Peng, Xiqian Yu, Delin Feng, Yuqiang Yang, Wenzhe Cai, Jing Xiong, Ganlin Yang, Jinliang Zheng, Jiafei Cao, Xueyuan Wei, Jiangmiao Pang, Yuan Shen, Tai Wang

机构 * Tsinghua University(清华大学) Shanghai AI Laboratory(上海人工智能实验室) Peking University(北京大学) USTC(中国科学技术大学)

专题命中 规划决策 :agent(title,abstract);planning(abstract);分类 cs.AI

AI总结 针对现有VLA模型长视距任务短板及分层方法语义-运动鸿沟问题,提出双向对齐框架Cortex,标准化技能原语、优化数据与采样策略,提升长视距操作性能与零样本泛化能力。

Comments Project website: https://steinate.github.io/cortex.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04963 2026-07-07 cs.AI 新提交 83%

STAPO: Selective Trajectory-Aware Policy Optimization for LLM Agent Training

STAPO:用于大语言模型智能体训练的选择性轨迹感知策略优化

Qiuyi Qi, Tian Liang, Mutian Bao, Jinjian Zhang, Dongnan Liu, Wei Zhou, Linjian Mo, Ming Kong, Jie Liu, Feng Zhang, Qiang Zhu

机构 * Zhejiang University(浙江大学) Ant Group(蚂蚁集团) City University of Hong Kong(香港城市大学) College of Artificial Intelligence, Shanghai Institute for Advanced Study, Zhejiang University(浙江大学上海高等研究院人工智能学院) School of Earth Sciences, Zhejiang University(浙江大学地球科学学院) Department of Computer Science, City University of Hong Kong(香港城市大学计算机科学系)

专题命中 规划决策 :agent(title,abstract);agentic(abstract);分类 cs.AI

AI总结 针对强化学习训练大语言模型智能体时轨迹忽视问题,提出归一化熵,引入STAPO框架,利用其定位异常步骤,通过联合机制优化,提升轨迹感知并保持训练稳定性,实验验证其有效性和鲁棒性。

Comments ACL 2026 MainConference

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04906 2026-07-07 cs.LG 新提交 83%

RL-Ballast: Ship Ballast Water Path Planning and Clog Prediction via Reinforcement Learning

RL-Ballast:通过强化学习进行船舶压载水路径规划和堵塞预测

Ming-Kuan Lin, Yi-Chung Lai, Ming-Hsin Chiang, Tsung-Wei Pan, Jung-Hua Wang

机构 * National Taiwan Ocean University(台湾海洋大学) AI Research Center(人工智能研究中心) Shinsoft Corporation(Shinsoft公司) Department of Electrical Engineering(电子工程系)

专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.LG

AI总结 针对船舶压载水控制问题,提出基于图的深度强化学习框架RL-Ballast,将阀门排列问题转化为可行路径,利用堆叠水箱水位等近似部分可观测环境,能自适应规划路径并进行堵塞诊断。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04409 2026-07-07 cs.LG 新提交 83%

Learning Task-Sufficient World Models by Synergizing Agentic Exploration and Structured Modeling

通过协同能动探索和结构化建模学习任务充分的世界模型

Fan Feng, Yujia Zheng, Minghao Fu, Yongqiang Chen, Guangyi Chen, Kevin Murphy, Biwei Huang, Kun Zhang

机构 * UCSD(加州大学圣地亚哥分校) MBZUAI(Mubarakzai Institute of Artificial Intelligence) CMU(卡内基梅隆大学) UBC(不列颠哥伦比亚大学)

专题命中 规划决策 :agentic(title);agent(abstract);planning(abstract);分类 cs.LG

AI总结 研究如何让智能体学习特定于任务、最小且足以决策的世界模型表示,通过智能体与世界模型闭环协同,智能体主动探索收集信息轨迹,世界模型学习结构化表示,提升样本效率和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03730 2026-07-07 cs.CL 新提交 83%

ProACT: Towards Breakdown-Aware Proactive Agent in Multi-User Collaboration

ProACT:迈向多用户协作中具有故障感知的主动智能体

Shu Yang, Difei Xu, Jiaxin Pei, Di Wang

机构 * PRADA Lab, King Abdullah University of Science and Technology(阿卜杜拉国王科技大学PRADA实验室) Stanford University(斯坦福大学)

专题命中 规划决策 :agent(title,abstract);planning(abstract);分类 cs.CL

AI总结 研究旨在使智能体在多用户协作中从被动变为主动,引入基于共同基础等理论的ProACT框架,通过观察对话历史判断是否需干预并决策,还介绍首个多用户协作基准,实验显示其性能优于直接聊天。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02927 2026-07-07 cs.CV cs.AI 新提交 83%

VideoSearcher: Empowering Video Deep Research with Multi-Tool Agentic Reasoning via Reinforcement Learning

VideoSearcher:通过强化学习利用多工具智能推理助力视频深度研究

Zhenkun Gao, Yicheng Bao, Jinlong Peng, Xueheng Li, Theo Huang, Bangwei Liu, Kunquan Li, Zhenye Gan, Tao Hu, Chengjun Xie, Mingqian Yang, Xuanhua He, Zhizhong Zhang, Xin Tan, Chengjie Wang, Yuan Xie

机构 * Stephengzk

专题命中 规划决策 :agentic(title,abstract);tool use(abstract);分类 cs.AI

AI总结 针对视频理解局限,提出VideoSearcher框架,统一多任务于单推理轨迹,用强化学习算法BiSPO优化推理轨迹,构建新基准,实验表明其在多基准中显著优于开源基线。

Comments Technical report. Project page: https://stephen-gzk.github.io/VideoSearcher-website/ ; Code: https://github.com/Stephen-gzk/VideoSearcher ; Model & Data on HuggingFace

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01767 2026-07-07 cs.AI 新提交 83%

Repair the Amplifier, Not the Symptom: Stable World-Model Correction for Agent Rollouts

修复放大器,而非症状:面向智能体轨迹的稳定世界模型修正

Xinyuan Song, Zekun Cai

机构 * Emory University(埃默里大学) The University of Tokyo(东京大学) LocationMind

专题命中 规划决策 :agent(title,abstract);planning(abstract);分类 cs.AI

AI总结 针对长流程规划中的图级错误,提出WM-SAR方法,通过子图放大反向定位因果子图进行修复,在有限token预算下优于传统扫描修复方法。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21534 2026-07-07 cs.AI 版本更新 83%

ARLArena: A Unified Framework for Stable Agentic Reinforcement Learning

ARLArena:用于稳定智能体强化学习的统一框架

Xiaoxuan Wang, Han Zhang, Haixin Wang, Yidan Shi, Ruoyan Li, Kaiqiao Han, Chenyi Tong, Haoran Deng, Renliang Sun, Alexander Taylor, Yanqiao Zhu, Jason Cong, Yizhou Sun, Wei Wang

机构 * University of California, Los Angeles(加州大学洛杉矶分校) University of Wisconsin–Madison(威斯康星大学麦迪逊分校)

专题命中 规划决策 :agentic(title,abstract);agent(abstract);分类 cs.AI

AI总结 研究针对智能体强化学习不稳定问题,提出ARLArena框架。先构建测试平台,将策略梯度分解为四个维度分析,据此提出稳定的智能体策略优化方法SAMPO,实现稳定训练与良好性能。

Comments To appear at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00972 2026-07-02 cs.AI 新提交 83%

Bayesian Uncertainty Propagation for Agentic RAG Pipelines: A Proof-of-Concept Study on Multi-Hop Question Answering

面向智能体RAG管道的贝叶斯不确定性传播:多跳问答的概念验证研究

Louis Donaldson, Connor Walker, Koorosh Aslansefat, Yiannis Papadopoulos

机构 * University of Hull(赫尔大学)

专题命中 规划决策 :agentic(title,abstract);workflow(abstract);分类 cs.AI

AI总结 提出一种不确定性感知的智能体RAG框架,通过贝叶斯网络传播各阶段的不确定性信号,以估计系统级不确定性并定位潜在故障点,在HotpotQA上表现有效,但在StrategyQA上受限于校准问题。

Comments Submitted for 7th International Conference on Maintenance and Intelligent Asset Management (ICMIAM 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00820 2026-07-02 cs.SE 新提交 83%

Knowledge-Enhanced Agentic Vulnerability Repair

知识增强的智能体漏洞修复

Sicong Cao, Hao Ma, Le Yu, Kangyi Ding, Xiaolei Liu, Terry Yue Zhuo, Bo Wang, Xingwei Lin, Xiaobing Sun, Linzhang Wang, David Lo

专题命中 规划决策 :agentic(title,abstract);agent(abstract);分类 cs.SE

AI总结 提出KeaRepair,一种基于智能体的自动化漏洞修复方法,通过提取历史漏洞知识并利用工具增强的智能体进行诊断,生成并迭代优化补丁,在55个C/C++漏洞上修复率达83.64%。

详情

展开后加载摘要…

URL PDF HTML 收藏