arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 35471 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 35471 篇

2604.21453 2026-04-24 cs.CV 82%

Instance-level Visual Active Tracking with Occlusion-Aware Planning

实例级视觉主动跟踪与遮挡感知规划

Haowei Sun, Kai Zhou, Hao Gao, Shiteng Zhang, Jinwu Hu, Xutao Wen, Qixiang Ye, Mingkui Tan

机构 * South China University of Technology(南方科技大学) Pazhou Laboratory(Pazhou实验室) Key Laboratory of Big Data and Intelligent Robot, Ministry of Education(教育部大数据与智能机器人重点实验室) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出OA-VAT方法,通过实例感知原型初始化、在线原型增强跟踪和遮挡感知轨迹规划模块,解决遮挡和相似干扰问题,实现高精度实时跟踪。

Comments CVPR 2026 Poster

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17656 2026-04-24 cs.SD cs.AI cs.CL cs.CV cs.LG 82%

Video-Robin: Autoregressive Diffusion Planning for Intent-Grounded Video-to-Music Generation

Video-Robin:基于意图的视频到音乐生成的自回归扩散规划

Vaibhavi Lokegaonkar, Aryan Vijay Bhosale, Vishnu Raj, Gouthaman KV, Ramani Duraiswami, Lie Lu, Sreyan Ghosh, Dinesh Manocha

机构 * University of Maryland College Park(马里兰大学College Park分校) Dolby Laboratories(杜比实验室) NVIDIA(英伟达)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 Video-Robin通过结合自回归规划与扩散合成,实现高质量的语义对齐音乐生成,相比传统方法在速度和质量上均有显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07262 2026-04-24 cs.HC 82%

ColorBrowserAgent: Complex Long-Horizon Browser Agent with Adaptive Knowledge Evolution

ColorBrowserAgent:具有自适应知识演化的复杂长 horizon 浏览器代理

Jihong Wang, Jiamu Zhou, Weiming Zhang, Teng Wang, Weiwen Liu, Zhuosheng Zhang, Xingyu Lou, Weinan Zhang, Huarong Deng, Jun Wang

专题命中 规划决策 :agent(title,abstract);autonomous agent(abstract)

AI总结 本文提出ColorBrowserAgent,通过人类在环的知识适应和知识对齐的渐进总结机制,解决网页自动化中的长周期不稳定性与领域特定先验知识缺乏问题,实验表明其在WebArena和工业部署中均表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09574 2026-04-23 cs.RO 82%

Online Structure Learning and Planning for Autonomous Robot Navigation using Active Inference

基于主动推断的自主机器人导航在线结构学习与规划

Daria de tinguy, Tim Verbelen, Emilio Gamba, Bart Dhoedt

机构 * Ghent University(根特大学) Verses FlandersMake(弗拉芒制造)

专题命中 规划决策 :planning(title,abstract);agent(abstract)

AI总结 本文提出AIMAPP框架,通过统一生成模型实现映射、定位和决策,支持在不确定环境中自主探索和导航,无需预定义地图或大量训练。

Comments yet to be submitted

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22650 2026-04-22 cs.CV cs.RO 82%

MAGICIAN: Efficient Long-Term Planning with Imagined Gaussians for Active Mapping

MAGICIAN: 通过想象高斯分布实现高效的长期规划用于主动建图

Shiyao Li, Antoine Guédon, Shizhe Chen, Vincent Lepetit

机构 * LIGM, École Nationale des Ponts et Chaussées, IP Paris, Univ Gustave Eiffel, CNRS, France(LIGM,巴黎国立桥梁与道路学院,IP巴黎,格雷夫埃菲尔大学,法国国家科学研究中心,法国) École Polytechnique, France(法国高等理工学院,法国) Inria, École normale supérieure, CNRS, PSL Research University, France(法国国家科学研究中心,巴黎高等师范学院,法国国家信息与自动化技术研究院,法国)

专题命中 规划决策 :planning(title,abstract);agent(abstract)

AI总结 MAGICIAN通过想象高斯分布实现高效长期规划,提升主动建图的探索效率与重建完整性,适用于不同动作空间的室内和室外基准测试。

Comments Accepted at CVPR 2026 (Oral). Project webpage: https://shiyao-li.github.io/magician/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21020 2026-04-22 cs.RO 82%

Hybrid Task and Motion Planning with Reactive Collision Handling for Multi-Robot Disassembly of Complex Products: Application to EV Batteries

混合任务与运动规划与反应碰撞处理用于多机器人复杂产品拆解:应用于电动汽车电池

Abdelaziz Shaarawy, Cansu Erdogan, Rustam Stolkin, Alireza Rastegarpanah

机构 * Extreme Robotics Laboratory, School of Metallurgy and Materials, University of Birmingham(极端机器人实验室,冶金与材料学院,伯明翰大学) Department of Applied Artificial Intelligence and Robotics, Aston University(应用人工智能与机器人学院,阿斯顿大学)

专题命中 规划决策 :planning(title,abstract);agent(abstract)

AI总结 本文提出一种基于视觉的任务与运动规划框架,用于多机器人协同拆解复杂产品,通过学习型RRT规划器和混合安全层提高路径紧凑性和安全性,实验显示在电动汽车电池拆解中显著降低路径长度和扫过体积。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16958 2026-04-21 cs.CV 82%

Self-Reasoning Agentic Framework for Narrative Product Grid-Collage Generation

具有自我推理代理机制的叙事产品网格-拼贴生成框架

Minyan Luo, Yuxin Zhang, Yifei Li, Xincan Wang, Fuzhang Wu, Tong-Yee Lee, Oliver Deussen, Weiming Dong

机构 * MAIS,Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所马克思主义学院) Tsinghua University(清华大学) Shanghai Theatre Academy(上海戏剧学院) Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所) National Cheng Kung University(国立成功大学) University of Konstanz(康斯坦茨大学)

专题命中 规划决策 :agentic(title,abstract);planning(abstract)

AI总结 本文提出一种自我推理代理框架,用于生成叙事产品网格拼贴,通过构建产品叙事框架和约束-aware提示,提升视觉一致性和叙事丰富度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10029 2026-04-21 cs.IR 82%

Self-Distilled Reinforcement Learning for Co-Evolving Agentic Recommender Systems

基于共演代理推荐系统的自我蒸馏强化学习

Zongwei Wang, Min Gao, Hongzhi Yin, Junliang Yu, Tong Chen, Quoc Viet Hung Nguyen, Shazia Sadiq, Tianrui Li

专题命中 规划决策 :agentic(title,abstract);agent(abstract)

AI总结 本文提出CoARS框架,通过交互奖励和自我蒸馏信用分配,解决传统ARs在交互性和轨迹监督方面的不足,提升推荐性能和用户对齐度。

Comments 13 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06211 2026-04-21 cs.CL cs.AI cs.SE 82%

Illocutionary Explanation Planning for Source-Faithful Explanations in Retrieval-Augmented Language Models

意图解释规划:在检索增强语言模型中实现源忠实的解释

Francesco Sovrano, Alberto Bacchelli

机构 * Collegium Helveticum, ETH Zurich(瑞士苏黎世联邦理工学院学院) University of Zurich(瑞士苏黎世大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.CL、cs.SE

AI总结 研究通过意图宏观规划提升检索增强语言模型中解释的源忠实性,通过链式意图提示提升源忠实度,实验显示在部分模型中提升显著,但整体效果仍有限。

Comments 24 pages; Accepted for publication at XAI'2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13942 2026-04-16 cs.RO 82%

Goal2Skill: Long-Horizon Manipulation with Adaptive Planning and Reflection

Goal2Skill:基于自适应规划与反思的长时程操作

Zhen Liu, Xinyu Ning, Zhe Hu, Xinxin Xie, Weize Li, Zhipeng Tang, Chongyu Wang, Zejun Yang, Hanlin Wang, Yitong Liu, Zhongzhu Pu

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Tsinghua University(清华大学)

专题命中 规划决策 :planning(title,abstract);agentic(abstract)

AI总结 本文提出双系统框架,通过分离高层语义推理与低层运动执行,提升长时程操作的鲁棒性和适应性,实验表明其在RMBench任务中显著优于基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10605 2026-04-16 cs.RO 82%

LEO-RobotAgent: A General-purpose Robotic Agent for Language-driven Embodied Operator

LEO-RobotAgent: 一种通用的基于语言的机器人代理框架

Lihuang Chen, Xiangyu Luo, Jun Meng

机构 * Zhejiang University, Hangzhou 310000, P. R. China(浙江大学,杭州310000,中华人民共和国)

专题命中 规划决策 :agent(title,abstract);planning(abstract)

AI总结 本文提出LEO-RobotAgent框架,旨在通过语言驱动实现机器人在复杂场景中完成多样化任务,具备强泛化能力、鲁棒性和高效性,降低人机交互门槛。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12628 2026-04-15 math.OC cs.RO 82%

A Comparison of Reinforcement Learning and Optimal Control Methods for Path Planning

强化学习与最优控制方法在路径规划中的比较

Qiang Le, Yaguang Yang, Isaac E. Weintraub

机构 * Department of Electrical and Computer Engineering, Hampton University(哈珀学院电气与计算机工程系) Air Warfare Directorate, Air Force Research Laboratory(空军研究实验室空战 Directorate)

专题命中 规划决策 :planning(title,abstract);agent(abstract)

AI总结 本文比较了强化学习与最优控制方法在路径规划中的应用,提出基于DDPG的方法能快速生成安全路径,但存在不可行区域,未来将改进奖励函数和探索其他方法。

Comments 8 pages, 9 figures, submitted to AAAI Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11686 2026-04-14 cs.IR 82%

EA-Agent: A Structured Multi-Step Reasoning Agent for Entity Alignment

EA-Agent:一种用于实体对齐的结构化多步推理代理

Yixuan Nan, Xixun Lin, Yanmin Shang, Ge Zhang, Zheng Fang, Fang Fang, Yanan Cao

专题命中 规划决策 :agent(title,abstract);planning(abstract)

AI总结 本文提出EA-Agent,通过多步规划与执行将实体对齐转化为结构化推理过程,引入属性和关系三元组选择器提升效率,实验表明其在三个基准数据集上均优于现有方法。

Comments ACL 2026,Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26163 2026-04-14 cs.CY 82%

Exploring Dissatisfaction in Bus Route Reduction through LLM-Calibrated Agent-Based Modeling

通过LLM校准的Agent-Based建模探索公交路线削减中的不满

Qiumeng Li, Xinxi Yang, Suhong Zhou

专题命中 规划决策 :agent(title,abstract);planning(abstract)

AI总结 研究通过LLM校准的ABM探讨公交路线削减对不同群体不满及网络韧性的影响,发现网络结构对系统稳定性影响大于容量因素,路线削减导致不满指数急剧上升,尤其影响残疾人士和老年人。

Comments The authors have withdrawn this preprint due to errors in figure presentation and labeling. A revised manuscript will be submitted once these issues are resolved

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22942 2026-04-14 cs.MA 82%

ClawMobile: Rethinking Smartphone-Native Agentic Systems

ClawMobile:重新思考原生智能手机代理系统

Hongchao Du, Shangyu Wu, Qiao Li, Riwei Pan, Jinheng Li, Youcheng Sun, Chun Jason Xue

专题命中 规划决策 :agentic(title,abstract);planning(abstract)

AI总结 本文提出ClawMobile,一种针对智能手机环境的代理系统架构,通过分层设计提升执行稳定性与可重复性,并探讨移动LLM运行时的关键挑战。

Comments Accepted at EuroMLSys 2026, 7 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09036 2026-04-13 cs.RO 82%

V-CAGE: Vision-Closed-Loop Agentic Generation Engine for Robotic Manipulation

V-CAGE:用于机器人操作的视觉闭环代理生成引擎

Yaru Liu, Ao-bo Wang, Nanyang Ye

机构 * University of Cambridge(剑桥大学) Wuhan University(武汉大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 规划决策 :agentic(title,abstract);planning(abstract)

AI总结 V-CAGE通过闭环代理生成框架实现机器人数据合成,结合语义布局规划和视觉自验证,提升环境生成的语义结构和可达性,解决传统方法在场景生成中的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07774 2026-04-10 cs.RO cs.CV 82%

RoboAgent: Chaining Basic Capabilities for Embodied Task Planning

RoboAgent: 通过基本能力串联实现具身任务规划

Peiran Xu, Jiaqi Zheng, Yadong Mu

机构 * Peking University(北京大学) XYZ Embodied AI(XYZ具身智能)

专题命中 规划决策 :planning(title,abstract);agent(abstract)

AI总结 本文提出RoboAgent,通过串联基本能力实现具身任务规划,利用单个VLM构建能力驱动的规划框架,结合多阶段训练方法提升规划效果。

Comments CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06427 2026-04-09 cs.LG cs.AI cs.CL 82%

The Depth Ceiling: On the Limits of Large Language Models in Discovering Latent Planning

深度上限:大语言模型在发现潜在规划中的局限性

Yi Xu, Philipp Jettkant, Laura Ruis

机构 * University of Cambridge(剑桥大学) Imperial College London(帝国理工学院) MIT(麻省理工学院)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 研究探讨了大语言模型在无监督情况下发现多步规划策略的极限,发现模型在单次前向传递中能执行最多七步潜在规划,揭示了训练与测试时能力的差异。

Comments 10 pages, 3 figures, 1 table (30 pages, 9 figures, 10 tables including references and appendices)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05159 2026-04-08 cs.SE cs.AI cs.CL 82%

Planning to Explore: Curiosity-Driven Planning for LLM Test Generation

规划以探索:基于好奇心的规划用于LLM测试生成

Alfonso Amayuelas, Firas Laakom, Piotr Piękos, Wenyi Wang, Yifan Xu, Yuhui Wang, Jürgen Schmidhuber, William Wang

机构 * University of California, Santa Barbara(加州大学圣塔芭芭拉分校) King Abdullah University of Science and Technology(阿卜杜拉国王科技大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.CL、cs.SE

AI总结 本文提出CovQValue方法,通过将覆盖地图反馈给LLM生成多样化计划,并利用LLM估计的Q值选择最信息量的计划,以平衡即时分支发现与未来可达性,优于贪心策略,在测试生成任务中取得更高覆盖率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13218 2026-04-07 cs.AI cs.CL cs.LG cs.LO 82%

Scaling the Scaling Logic: Agentic Meta-Synthesis of Logic Reasoning

扩展扩展逻辑:代理元合成逻辑推理

Bowen Liu, Zhi Wu, Runquan Xie, Zhanhui Kang, Jia Li

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文提出SSLogic框架,通过代理迭代生成和优化可执行的生成器-验证器对,生成具有新规则和难度梯度的任务家族,提升训练效率。

Comments 41 pages, 8 figures, 5 tables in the main body. Project page: https://github.com/AdAstraAbyssoque/Scaling-the-Scaling-Logic, typos corrected, claims cleared

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03796 2026-04-07 cs.MA 82%

When AI Agents Disagree Like Humans: Reasoning Trace Analysis for Human-AI Collaborative Moderation

当AI代理像人类一样产生分歧:用于人机协作 moderation 的推理轨迹分析

Michał Wawer, Jarosław A. Chudziak

专题命中 规划决策 :AI agent(title);agent(abstract);multi-agent(abstract)

AI总结 本文研究AI代理在仇恨言论 moderation 中的分歧模式,通过推理轨迹分析发现分歧结构比幅度更能预测人类判断需求,提出从共识寻求转向不确定性揭示的多代理设计。

Comments Accepted to the ICLR 2026 Workshop on "From Human Cognition to AI Reasoning: Models, Methods, and Applications (HCAIR)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03691 2026-04-07 astro-ph.GA astro-ph.IM 82%

LensAgent: A Self Evolving Agent for Autonomous Physical Inference of Sub-galactic Structure

LensAgent:一种用于自主物理推断亚银河结构的自演化代理

Xiaotang Feng, Zihan Wang, Zilang Shu, Jean-Paul Kneib, Philip Torr

专题命中 规划决策 :agent(title,abstract);agentic(abstract)

AI总结 本文提出LensAgent,一种无需训练的大型语言模型驱动框架,用于自主推断质量分布,克服了质量片退化和手动或神经网络建模的可扩展性问题,成功重建了SLACS Grade A强引力透镜系统的质量分布。

详情

展开后加载摘要…

URL PDF HTML 收藏
2011.01882 2026-04-07 cs.RO cs.GT 82%

Secure Planning Against Stealthy Attacks via Model-Free Reinforcement Learning

通过模型无关强化学习实现对隐蔽攻击的安全规划

Alper Kamil Bozkurt, Yu Wang, Miroslav Pajic

机构 * Duke University(杜克大学)

专题命中 规划决策 :planning(title,abstract);agent(abstract)

AI总结 本文提出利用模型无关强化学习在未知随机环境中实现安全规划,通过将攻击者与控制器视为博弈双方,以线性时序逻辑公式表达其目标,解决在未知环境中满足LTL公式的问题。

Journal ref 2021 IEEE International Conference on Robotics and Automation (ICRA), Xi'an, China, 2021, pp. 10656-10662

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02501 2026-04-06 eess.SP 82%

ECG Foundation Models and Medical LLMs for Agentic Cardiovascular Intelligence at the Edge: A Review and Outlook

ECG基础模型与医疗大语言模型用于边缘端心血管智能:综述与展望

Mudassir Hasan Khan, Ahmad Nayfeh, Mudassir Masood, Ali Ahmad Al-Shaikhi, Muhammad Mahboob Ur Rahman, Tareq Y. Al-Naffouri

专题命中 规划决策 :agentic(title,abstract);agent(abstract)

AI总结 本文综述了用于心血管疾病诊断、监测和临床决策支持的ECG基础模型和医疗大语言模型,探讨了其在边缘计算中的应用及未来发展方向。

Comments 18 pages, 4 figures, 4 tables, under review with a journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02289 2026-04-03 cs.DB 82%

Multi-Objective Agentic Rewrites for Unstructured Data Processing

多目标代理重写用于无结构数据处理

Lindsey Linxi Wei, Shreya Shankar, Sepanta Zeighami, Yeounoh Chung, Fatma Ozcan, Aditya G. Parameswaran

专题命中 规划决策 :agentic(title,abstract);planning(abstract)

AI总结 MOAR通过引入新的指令类别和全局搜索算法,提升DocETL在准确性和成本上的优化能力,实现更高的准确性并匹配最佳成本。

Comments 24 pages, 8 figures, 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00659 2026-04-02 eess.SY cs.SY 82%

Battery Electric Truck Infrastructure Co-design via Joint Optimization and Agent-based Simulation

通过联合优化和基于代理的仿真设计电池电动卡车基础设施

Juan Pablo Bertucci, Mauro Salazar, Theo Hofman

专题命中 规划决策 :agent(title,abstract);planning(abstract)

AI总结 本文通过联合优化和基于代理的仿真,研究了物流配送网络中充电基础设施与调度的协同设计,验证了优化框架在荷兰案例中的有效性,展示了优化策略在降低成本和减少排队时间方面的优势。

Journal ref IEEE Transactions on Transportation Electrification, vol. 11, no. 5, pp. 11296-11306, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00320 2026-04-02 cs.RO cs.SY eess.SY 82%

Hierarchical Motion Planning and Control under Unknown Nonlinear Dynamics via Predicted Reachability

通过预测可达性在未知非线性动力学下进行分层运动规划与控制

Zhiquan Zhang, Melkior Ornik

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 规划决策 :planning(title,abstract);agent(abstract)

AI总结 本文提出一种分层规划-控制框架,通过分步逼近未知非线性系统,利用可达性理论和预测可达性条件保证运动规划的正式可达性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08815 2026-03-26 cs.MA 82%

Agent Contracts: A Formal Framework for Resource-Bounded Autonomous AI Systems

智能体合同:资源受限自主AI系统的正式框架

Qing Ye, Jing Tan

专题命中 规划决策 :agent(title,abstract);multi-agent(abstract)

AI总结 本文提出智能体合同框架,通过正式机制规范资源使用和运行时间,实现多智能体协调中的预算守恒与层次化控制,实验显示显著提升效率与资源管理可控性。

Comments v3: Minor fixes and workshop acceptance indication

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22866 2026-03-25 cs.IT math.IT 82%

Aerial Agentic AI: Synergizing LLM and SLM for Low-Altitude Wireless Networks

空域代理AI:融合LLM和SLM用于低空无线网络

Li Dong, Feibo Jiang, Kezhi Wang, Cunhua Pan, Dong In Kim, Ekram Hossain

专题命中 规划决策 :agentic(title,abstract);agent(abstract)

AI总结 本文提出空域代理AI框架,通过融合小型语言模型和大型语言模型,解决低空无线网络中的计算、通信和实时性冲突问题,实现高效协同与决策优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21726 2026-03-24 eess.SY cs.SY 82%

LSAI: A Large Small AI Model Codesign Framework for Agentic Robot Scenarios

LSAI:一种面向智能体机器人场景的大型小型AI模型协同设计框架

Longyu Zhou, Supeng Leng, Tianhao Liang, Jianping Yao

专题命中 规划决策 :agentic(title,abstract);planning(abstract)

AI总结 本文提出LSAI框架,通过大小型AI模型深度交互提升机器人协作的准确性和实时性,实验表明其在环境感知准确率和协作延迟方面优于传统方法。

Comments 7 pages

详情

展开后加载摘要…

URL PDF HTML 收藏