arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 35394 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 35394 篇

2511.20718 2026-02-26 cs.LG cs.AI cs.CL 85%

Stabilizing Off-Policy Training for Long-Horizon LLM Agent via Turn-Level Importance Sampling and Clipping-Triggered Normalization

通过回合级重要性采样和触发式归一化稳定长时程LLM代理的离策略训练

Chenliang Li, Adel Elmahdy, Alex Boyd, Zhongruo Wang, Siliang Zeng, Alfredo Garcia, Parminder Bhatia, Taha Kass-Hout, Cao Xiao, Mingyi Hong

机构 * Texas A&M University(德克萨斯A&M大学) GE HealthCare(通用电气医疗) University of Minnesota(明尼苏达大学)

专题命中 规划决策 :agent(title,abstract);agentic(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 SORL通过回合级重要性采样和触发式归一化稳定长时程LLM代理的离策略训练,减少梯度方差并防止优化崩溃。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15329 2026-02-18 cs.CV 85%

EventMemAgent: Hierarchical Event-Centric Memory for Online Video Understanding with Adaptive Tool Use

EventMemAgent: 基于分层事件中心记忆的在线视频理解与自适应工具使用

Siwei Wen, Zhangcheng Wang, Xingjian Zhang, Lei Huang, Wenjun Wu

机构 * Beijing Advanced Innovation Center for Future Blockchain and Privacy Computing, School of Artificial Intelligence, Beihang University(北京未来区块链与隐私计算先进创新中心,人工智能学院,北京航空航天大学) Hangzhou International Innovation Institute, Beihang University(杭州国际创新研究院,北京航空航天大学) Paradigm Inc.(4Paradigm公司)

专题命中 规划决策 :tool use(title);agent(abstract);tool-use(abstract);agentic(abstract)

AI总结 EventMemAgent通过分层事件中心记忆和自适应工具使用,解决在线视频理解中长程推理与细粒度细节的平衡问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14799 2026-02-17 cs.RO quant-ph 85%

Scalable Multi-Robot Path Planning via Quadratic Unconstrained Binary Optimization

通过二次无约束二元优化实现可扩展的多机器人路径规划

Javier González Villasmil

专题命中 规划决策 :planning(title,abstract);agent(abstract);multi-agent(abstract)

AI总结 本文提出了一种基于二次无约束二元优化的多机器人路径规划方法,通过逻辑预处理和时间窗口分解策略实现了高效且可扩展的路径规划。

Comments 21 pages, 9 figures, 1 table. Accompanying open-source implementation at https://github.com/JavideuS/Spooky

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14589 2026-02-17 cs.AI cs.CL cs.LG 85%

MATEO: A Multimodal Benchmark for Temporal Reasoning and Planning in LVLMs

MATEO:一种多模态基准,用于LVLMs中的时间推理和规划

Gabriel Roccabruna, Olha Khomyn, Giuseppe Riccardi

机构 * Signals and Interactive Systems Lab, University of Trento, Italy(特伦托大学信号与交互系统实验室) University of Trento(特伦托大学) Amazon(亚马逊)

专题命中 规划决策 :planning(title,abstract);AI agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 MATEO是一个多模态基准,用于评估和提升大型视觉语言模型在时间推理和规划方面的能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16198 2026-02-16 cs.CL cs.AI cs.SE 85%

RPG: A Repository Planning Graph for Unified and Scalable Codebase Generation

RPG:一个用于统一和可扩展代码库生成的仓库规划图

Jane Luo, Xin Zhang, Steven Liu, Jie Wu, Jianfeng Liu, Yiming Huang, Yangyu Huang, Chengyu Yin, Ying Xin, Yuefeng Zhan, Hao Sun, Qi Chen, Scarlett Li, Mao Yang

机构 * Microsoft(微软公司) Tsinghua University(清华大学) University of California, San Diego(加州大学圣地亚哥分校) Beijing Jiaotong University(北京交通大学)

专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.AI、cs.CL、cs.SE

AI总结 RPG通过统一的图结构提升代码库生成效率,ZeroRepo在真实项目基准上实现显著更高的代码生成量和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10490 2026-02-12 cs.IR 85%

ChainRec: An Agentic Recommender Learning to Route Tool Chains for Diverse and Evolving Interests

ChainRec: 一个用于路由工具链的代理推荐学习系统,以应对多样化和演变的兴趣

Fuchun Li, Qian Li, Xingyu Gao, Bocheng Pan, Yang Wu, Jun Zhang, Huan Yu, Jie Jiang, Jinsheng Xiao, Hailong Shi

专题命中 规划决策 :agentic(title,abstract);agent(abstract);planning(abstract)

AI总结 ChainRec通过动态选择推理工具的代理推荐系统,提升冷启动和兴趣演变场景下的推荐性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23189 2026-02-10 eess.SY cs.SY 85%

The Dawn of Agentic EDA: A Survey of Autonomous Digital Chip Design

代理EDA的黎明:自主数字芯片设计的综述

Zelin Zang, Yuhang Song, Aili Wang, Bingo Wing-Kuen Ling, Qi Sun, Zhen Lei, Fuji Yang, Cheng Zhuo, Jiebo Luo

专题命中 规划决策 :agentic(title,abstract);agent(abstract);planning(abstract)

AI总结 本文提出代理EDA的系统框架,通过认知堆栈分析前端和后端设计流程,强调神经符号优化和可信度提升的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00566 2026-02-03 cs.RO 85%

UniMotion: A Unified Motion Framework for Simulation, Prediction and Planning

UniMotion: 一种用于仿真、预测和规划的统一运动框架

Nan Song, Junzhe Jiang, Jingyu Li, Xiatian Zhu, Li Zhang

机构 * School of Data Science, Fudan University(复旦大学数据科学学院) Shanghai Innovation Institute(上海创新研究院) University of Surrey(Surrey大学)

专题命中 规划决策 :planning(title,abstract);agent(abstract);multi-agent(abstract)

AI总结 UniMotion提出了一种统一的运动框架,通过共享结构和定制化训练策略,同时支持运动仿真、预测和规划,实现高效的任务整合和泛化能力。

Comments Accepted at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01945 2026-02-03 cs.LG cs.AI cs.CL 85%

Agentic Policy Optimization via Instruction-Policy Co-Evolution

通过指令-策略共演进行代理策略优化

Han Zhou, Xingchen Wan, Ivan Vulić, Anna Korhonen

机构 * Language Technology Lab, University of Cambridge(剑桥大学语言技术实验室) Machine Learning Research Group, University of Oxford(牛津大学机器学习研究组)

专题命中 规划决策 :agentic(title);agent(abstract);autonomous agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 INSPO通过指令与策略的共演机制,动态优化指令以提升代理在多轮检索和推理任务中的性能,显著优于静态指令基线。

Comments 8 pages, 4 figures, 1 table (17 pages including references and appendices)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22311 2026-02-02 cs.AI cs.CL cs.LG 85%

Why Reasoning Fails to Plan: A Planning-Centric Analysis of Long-Horizon Decision Making in LLM Agents

为何推理无法规划:从规划角度分析LLM代理在长周期决策中的表现

Zehong Wang, Fang Wu, Hongru Wang, Xiangru Tang, Bolian Li, Zhenfei Yin, Yijun Ma, Yiyang Li, Weixiang Sun, Xiusi Chen, Yanfang Ye

机构 * University of Notre Dame(诺丁汉大学) Stanford University(斯坦福大学) Purdue University(普渡大学) University of Edinburgh(爱丁堡大学) University of Oxford(牛津大学) Yale University(耶鲁大学)

专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文从规划角度分析LLM代理在长周期决策中的失败原因,提出FLARE方法通过前瞻和价值传播提升规划能力,使LLaMA-8B在多个基准中超越GPT-4o。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17566 2026-01-27 cs.CV 85%

Sponge Tool Attack: Stealthy Denial-of-Efficiency against Tool-Augmented Agentic Reasoning

Sponge Tool Attack:针对工具增强代理推理的隐蔽低效攻击

Qi Li, Xinchao Wang

专题命中 规划决策 :agentic(title,abstract);agent(abstract);multi-agent(abstract)

AI总结 Sponge Tool Attack通过重写输入提示,隐蔽地破坏工具增强代理推理的效率,验证了其在多种模型和工具上的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16984 2026-01-27 cs.LG cs.AI cs.CL cs.CV cs.IR cs.MM 85%

TelcoAI: Advancing 3GPP Technical Specification Search through Agentic Multi-Modal Retrieval-Augmented Generation

TelcoAI: 通过代理多模态检索增强生成技术推进3GPP技术规范搜索

Rahul Ghosh, Chun-Hao Liu, Gaurav Rele, Vidya Sagar Ravipati, Hazar Aouad

机构 * Generative AI Innovation Center, Amazon Web Services (AWS)(生成式AI创新中心,亚马逊网络服务)

专题命中 规划决策 :agentic(title,abstract);planning(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 TelcoAI通过代理多模态检索增强生成技术,提升3GPP技术规范搜索的准确性和效率,实现87%的召回率和16%的性能提升。

Comments Accepted to IJCNLP-AACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10820 2026-01-19 cs.LG cs.AI cs.CL cs.MA 85%

Towards Reliable ML Feature Engineering via Planning in Constrained-Topology of LLM Agents

通过LLM代理的受限拓扑规划实现可靠的机器学习特征工程

Himanshu Thakur, Anusha Kamath, Anurag Muthyala, Dhwani Sanmukhani, Smruthi Mukund, Jay Katukuri

机构 * Meta Menlo Park, CA(Meta 洛杉矶公园分校) JPMorgan Chase & Co.(摩根大通公司)

专题命中 规划决策 :planning(title);agent(abstract);multi-agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文提出了一种基于LLM代理的受限拓扑规划框架,通过多步骤生成代码提升特征工程的可靠性与效率,实验显示在数据集和实际应用中均取得显著改进。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04698 2026-01-09 cs.AI cs.CL cs.LG 85%

TourPlanner: A Competitive Consensus Framework with Constraint-Gated Reinforcement Learning for Travel Planning

TourPlanner: 一种基于约束门控强化学习的竞争共识框架用于旅行规划

Yinuo Wang, Mining Tan, Wenxiang Jiao, Xiaoxi Li, Hao Wang, Xuanyu Zhang, Yuan Lu, Weiming Dong

机构 * Xiaohongshu Inc.(小红书公司) Renmin University of China(中国人民大学) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) MAIS, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所MAIS)

专题命中 规划决策 :planning(title,abstract);workflow(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 TourPlanner通过多路径推理和约束门控强化学习,解决旅行规划中候选点修剪、探索能力限制和约束优化难题,实现更高效的行程生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08930 2026-01-08 cs.GR 85%

How Does a Virtual Agent Decide Where to Look? Symbolic Cognitive Reasoning for Embodied Head Rotation

虚拟代理如何决定看向何处?基于具身头部旋转的符号认知推理

Juyeong Hwang, Seong-Eun Hong, JaeYoung Seon, Hyeongyeop Kang

专题命中 规划决策 :agent(title,abstract);workflow(abstract);multi-agent(abstract)

AI总结 本文提出SCORE框架,通过符号认知推理实现具身头部旋转,结合视觉-语言模型和大语言模型,使虚拟代理能合理预测头部运动及背后动机。

Comments 13 pages, 8 figures. Accepted to SIGGRAPH Asia Conference Papers '25

Journal ref SIGGRAPH Asia Conference Papers '25, December 15-18, 2025, Hongkong

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09548 2025-12-11 cs.MA 85%

Supporting Dynamic Agentic Workloads: How Data and Agents Interact

支持动态代理工作负载:数据与代理如何相互作用

Ioana Giurgiu, Michael E. Nidd

专题命中 规划决策 :agentic(title,abstract);agent(abstract);multi-agent(abstract)

AI总结 本文提出了一种以代理为中心的数据织物,旨在高效支持动态、多模态的代理工作负载,通过注意力引导的数据检索、语义微缓存等机制提升数据处理效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08737 2025-12-10 cs.CY cs.MA 85%

Insured Agents: A Decentralized Trust Insurance Mechanism for Agentic Economy

受保代理:一种用于代理经济的去中心化信任保险机制

Botao 'Amber' Hu, Bangdao Chen

专题命中 规划决策 :agentic(title,abstract);agent(abstract);autonomous agent(abstract)

AI总结 本文提出了一种去中心化的信任保险机制,通过抵押金和TEE技术解决代理经济中的信任问题,实现安全、高效的纠纷解决。

Comments Submitted to AAMAS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01132 2025-12-09 cs.LG cs.AI cs.CL 85%

A Practitioner's Guide to Multi-turn Agentic Reinforcement Learning

多轮代理强化学习实践指南

Ruiyi Wang, Prithviraj Ammanabrolu

机构 * University of California, San Diego(加州大学圣地亚哥分校) NVIDIA(英伟达)

专题命中 规划决策 :agentic(title,abstract);agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文提出多轮代理强化学习的训练方法,通过分析环境、奖励和策略三个支柱,总结出训练LLM代理的实践指南。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22037 2025-12-05 cs.CY 85%

What AI Speaks for Your Community: Polling AI Agents for Public Opinion on Data Center Projects

人工智能为你的社区发声:通过AI代理收集数据中心项目公众意见

Zhifeng Wu, Yuelin Han, Shaolei Ren

专题命中 规划决策 :AI agent(title,abstract);agent(abstract);planning(abstract)

AI总结 本文提出AI代理调查框架,利用大型语言模型评估社区对数据中心项目的意见,以指导负责任的AI发展。

Comments 35 Pages. Accepted to NeurIPS 2025 Workshop on Socially Responsible and Trustworthy Foundation Models (ResponsibleFM)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03756 2025-12-04 cs.RO 85%

Prediction-Driven Motion Planning: Route Integration Strategies in Attention-Based Prediction Models

基于预测的运动规划:注意力预测模型中的路线整合策略

Marlon Steiner, Royden Wagner, Ömer Sahin Tas, Christoph Stiller

机构 * Institute of Measurement and Control Systems, Karlsruhe Institute of Technology (KIT)(测量与控制系统研究所,卡尔斯鲁厄理工学院) FZI Research Center for Information Technology(信息技术研究所以)

专题命中 规划决策 :planning(title,abstract);agent(abstract);multi-agent(abstract)

AI总结 本文提出基于注意力机制的运动预测模型,通过整合导航信息提升预测与规划任务的性能。

Comments In Proceedings of the IEEE International Conference on Intelligent Transportation Systems (ITSC), Gold Coast, AUSTRALIA, 18-21 November 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07686 2025-11-21 cs.RO 85%

Risk Map As Middleware: Towards Interpretable Cooperative End-to-end Autonomous Driving for Risk-Aware Planning

风险地图作为中间件:迈向风险感知的可解释协作端到端自动驾驶

Mingyue Lei, Zewei Zhou, Hongchen Li, Jiaqi Ma, Jia Hu

机构 * Key Laboratory of Road and Traffic Engineering of the Ministry of Education, Tongji University(教育部道路与交通工程重点实验室,同济大学) UCLA Mobility Lab, University of California, Los Angeles(加州大学洛杉矶分校UCLA移动实验室)

专题命中 规划决策 :planning(title,abstract);agent(abstract);multi-agent(abstract)

AI总结 本文提出RiskMM框架,通过风险地图中间件提升自动驾驶的可解释性和风险感知规划能力。

Comments IEEE RA-L

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10586 2025-11-14 eess.SY cs.RO cs.SY 85%

Safe Planning in Interactive Environments via Iterative Policy Updates and Adversarially Robust Conformal Prediction

Omid Mirzaeedodangeh, Eliot Shekhtman, Nikolai Matni, Lars Lindemann

机构 * Automatic Control Laboratory (IfA)(自动控制实验室)

专题命中 规划决策 :planning(title,abstract);agent(abstract);autonomous agent(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10395 2025-11-14 cs.LG cs.AI cs.CL 85%

AgentEvolver: Towards Efficient Self-Evolving Agent System

Yunpeng Zhai, Shuchang Tao, Cheng Chen, Anni Zou, Ziqian Chen, Qingxu Fu, Shinji Mai, Li Yu, Jiaji Deng, Zouying Cao, Zhaoyang Liu, Bolin Ding, Jingren Zhou

机构 * Tongyi Lab(通义实验室) Alibaba Group(阿里巴巴集团)

专题命中 规划决策 :agent(title,abstract);autonomous agent(abstract);分类 cs.AI、cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08721 2025-11-13 cs.LG cs.AI cs.CL 85%

Benevolent Dictators? On LLM Agent Behavior in Dictator Games

Andreas Einwiller, Kanishka Ghosh Dastidar, Artur Romazanov, Annette Hautli-Janisz, Michael Granitzer, Florian Lemmerich

机构 * University of Passau(帕绍大学)

专题命中 规划决策 :agent(title,abstract);AI agent(abstract);分类 cs.AI、cs.CL、cs.LG

Comments 7 pages, 2 figures, v1 init

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24030 2025-11-12 cs.MA 85%

Human Machine Social Hybrid Intelligence:A Collaborative Decision Making Framework for Large Model Agent Groups and Human Experts

Ahmet Akkaya Melih, Yamuna Singh, Kunal L. Agarwal, Priya Mukherjee, Kiran Pattnaik, Hanuman Bhatia

专题命中 规划决策 :agent(title,abstract);AI agent(abstract);multi-agent(abstract)

Comments We have identified critical issues in the code implementation that severely deviate from Algorithm 1, invalidating all experimental results and conclusions. Despite exhaustive efforts to correct these issues, we find they fundamentally undermine the paper's core claims. To uphold academic integrity and prevent misinformation, we are withdrawing this manuscript

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03844 2025-11-07 cs.MA 85%

ASAP: an Agentic Solution to Auto-optimize Performance of Large-Scale LLM Training

Yuran Ding, Xinwei Chen, Xiaofan Zhang, Zongwei Zhou

专题命中 规划决策 :agentic(title,abstract);agent(abstract);multi-agent(abstract)

Comments This work has been accepted to Workshop on ML for Systems at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01833 2025-11-07 cs.CV 85%

TIR-Bench: A Comprehensive Benchmark for Agentic Thinking-with-Images Reasoning

Ming Li, Jike Zhong, Shitian Zhao, Haoquan Zhang, Shaoheng Lin, Yuxiang Lai, Chen Wei, Konstantinos Psounis, Kaipeng Zhang

机构 * Shanghai AI Laboratory(上海人工智能实验室) University of Southern California(南加州大学) Emory University(埃默里大学) Chinese University of Hong Kong(香港中文大学) Rice University(德克萨斯大学奥斯汀分校)

专题命中 规划决策 :agentic(title,abstract);tool use(abstract);tool-use(abstract)

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20637 2025-11-06 cs.LG cs.AI cs.CL 85%

GDS Agent for Graph Algorithmic Reasoning

Borun Shi, Ioannis Panagiotas

专题命中 规划决策 :agent(title,abstract);function calling(abstract);分类 cs.AI、cs.CL、cs.LG

Comments Technical report

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20578 2025-10-24 cs.CV cs.RO 85%

EmbodiedBrain: Expanding Performance Boundaries of Task Planning for Embodied Intelligence

Ding Zou, Feifan Wang, Mengyu Ge, Siyuan Fan, Zongbing Zhang, Wei Chen, Lingfeng Wang, Zhongyou Hu, Wenrui Yan, Zhengwei Gao, Hao Wang, Weizhao Jin, Yu Zhang, Hainan Zhao, Mingliang Zhang, Xianxian Xi, Yaru Zhang, Wenyuan Li, Zhengguang Gao, Yurui Zhu

机构 * ZTE NebulaBrain Team(ZTE NebulaBrain团队)

专题命中 规划决策 :planning(title,abstract);agent(abstract);AI agent(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09781 2025-10-14 cs.LG cs.AI cs.CL 85%

Building a Foundational Guardrail for General Agentic Systems via Synthetic Data

Yue Huang, Hang Hua, Yujun Zhou, Pengcheng Jing, Manish Nagireddy, Inkit Padhi, Greta Dolcetti, Zhangchen Xu, Subhajit Chaudhury, Ambrish Rawat, Liubov Nedoshivina, Pin-Yu Chen, Prasanna Sattigeri, Xiangliang Zhang

机构 * University of Notre Dame(诺特大学) MIT-IBM Watson AI Lab(MIT-IBM Watson AI实验室) University of Washington(华盛顿大学) Ca’ Foscari University of Venice(威尼斯卡福尔学院) IBM Research(IBM研究院)

专题命中 规划决策 :agentic(title,abstract);planning(abstract);分类 cs.AI、cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏