arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-07-16 至 2026-07-16 共收录 161 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 8 篇

2607.13474 2026-07-16 cs.CL 新提交 83%

MyAG: A Graph-Based Framework for Designing and Analyzing Composable LLM Agent Systems

MyAG:一种用于设计和分析可组合大语言模型智能体系统的基于图的框架

Zhisong Zhang

机构 * City University of Hong Kong(香港城市大学)

专题命中 工具调用 :agent(title,abstract);workflow(abstract);分类 cs.CL

AI总结 介绍用于设计和分析可组合大语言模型智能体系统的MyAG框架,它将构建分为三个图抽象,支持分层组合,提供监控和可视化工具,实验表明其能支持灵活设计并助于分析性能-效率权衡,且已开源。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13411 2026-07-16 cs.CR cs.LG 新提交 83%

Evaluating Frontier AI Agents as Autonomous Clinical Security Auditors

评估前沿人工智能代理作为自主临床安全审计员

Michael O. Eniolade

机构 * University of the Cumberlands(坎伯兰大学)

专题命中 工具调用 :AI agent(title,abstract);agent(abstract);分类 cs.LG

AI总结 研究旨在评估前沿人工智能代理能否自主进行临床人工智能安全审计。基于METR任务标准构建评估任务,让代理按要求实施攻击、计算得分并编写报告。通过对三个前沿模型在不同数据集和模型架构上的评估,得出各模型表现及成本等情况,部分成果已公开。

Comments 29 pages, 2 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14893 2026-07-16 cs.RO 版本更新 78%

STITCHER: Constrained Trajectory Planning in Complex Environments with Real-Time Motion Primitive Search

STITCHER:通过实时运动原语搜索在复杂环境中进行约束轨迹规划

Helene J. Levy, Brett T. Lopez

机构 * VECTR Laboratory, University of California, Los Angeles(VECTR实验室,加州大学洛杉矶分校)

专题命中 工具调用 :planning(title,abstract)

AI总结 研究针对自主高速穿越复杂环境的轨迹规划问题,提出无优化规划框架STITCHER,通过拼接短轨迹段和图搜索实时计算轨迹,经模拟与硬件测试验证其性能优越,能满足多种约束并高速实时规划。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11098 2026-07-16 cs.SE cs.AI cs.CL 版本更新 67%

AgentCheck: A Reproduce-Intervene-Mitigate Workbench for LLM Agents over MCP

AgentCheck:用于基于MCP的大型语言模型智能体的重现-干预-缓解工作台

Aritra Mazumder, Nusrat jahan Lia

机构 * University of Utah(犹他大学) University of Dhaka(达卡大学)

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.CL、cs.SE

AI总结 研究针对工具使用型大语言模型智能体在工具出现问题时开发者难以处理故障的情况,提出AgentCheck开源工作台,通过特定运行和重放方式形成重现-干预-确认循环,能对故障模式进行评估验证,提升智能体故障处理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13389 2026-07-16 cs.LG cs.CL 新提交 62%

Where Should RL Post-Training Compute Go? Model Size, Search, Learning, and Feedback

强化学习训练后计算资源应投向何处?模型大小、搜索、学习与反馈

Patrick Wilhelm, Odej Kao

机构 * Technische Universität Berlin(柏林工业大学)

专题命中 工具调用 :planning(abstract);分类 cs.CL、cs.LG

AI总结 研究强化学习训练后计算资源分配问题,引入浮点运算核算框架,通过LoRA适配的Qwen2.5策略发现条件分配前沿,揭示模型选择与训练分配关联及奖励系统对核算影响,提出RACE协议,建议相关论文报告总浮点运算及计算分配方式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00830 2026-07-16 cs.LG cs.AI 版本更新 62%

Learning to Learn-at-Test-Time: Language Agents with Learnable Adaptation Policies

在测试时学习:具有可学习适应策略的语言智能体

Zhanzhi Lou, Hui Chen, Yibo Li, Qian Wang, Bryan Hooi

机构 * National University of Singapore(新加坡国立大学)

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出Meta-TTL框架,通过双层优化问题学习最优适应策略,提升语言智能体在不同分布下的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13789 2026-07-16 cs.RO math.OC 新提交 50%

Dynamical Vehicle Orienteering Problem for Multi-Rotor Unmanned Aerial Vehicles

多旋翼无人机的动态车辆定向问题

František Nekovář, Matej Novosad, Martin Saska, Robert Pěnička

专题命中 工具调用 :planning(abstract)

AI总结 研究多旋翼无人机的动态车辆定向问题,提出结合非线性规划与混合整数线性规划的分支定界程序和大邻域搜索元启发式算法两种解决方案,实验表明改进显著,实际部署验证了所提质点模型解决方案轨迹。

Comments 28 pages, 10 figures, preprint submitted to European Journal of Operational Research

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13528 2026-07-16 cs.LO math.LO 新提交 50%

Intuitionistic Dynamic Logic

直觉主义动态逻辑

Lukas Zenger

专题命中 工具调用 :agent(abstract)

AI总结 研究直觉主义动态逻辑的数学理论,涵盖五种该逻辑。通过开发证明论工具、进行语义研究,建立相关性质与界限。主要贡献为开发演算、获有限模型性质及可判定性、给出直觉主义线性时态逻辑完备公理系统。

Comments PhD Thesis

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划决策 49 篇

2607.13081 2026-07-16 cs.CR cs.AI cs.CL cs.LG 新提交 85%

SingGuard-NSFA: Extensible Guardrails for Agentic AI via Generative Reasoning and Real-Time Classification

SingGuard-NSFA:通过生成式推理和实时分类实现的可扩展智能体人工智能护栏

SingGuard Team

机构 * Ant Group(蚂蚁集团)

专题命中 规划决策 :agentic(title,abstract);agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 研究针对智能体人工智能系统操作威胁,提出NSFA分类法构建基准套件,开发双模式方法,发布四个不同参数模型,在基准测试和跨源评估中表现出色,证明方法可扩展性与通用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12547 2026-07-16 cs.RO cs.AI cs.LG 版本更新 81%

Mind the Gap: Promises and Pitfalls of Hierarchical Planning in LeWorldModel

注意差距:LeWorldModel中分层规划的前景与陷阱

Niccolò Caselli, Francesco Massafra, Samuele Punzo, Salvatore Lo Sardo, Ippokratis Pantelidis, Sathya Kamesh Bhethanabhotla

机构 * University of Amsterdam(阿姆斯特丹大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.LG

AI总结 研究长期目标条件控制下时间层次结构对LeWorldModel的影响,提出Hi-LeWM扩展,通过冻结低级模型并添加高级规划。实验发现层次结构需合理设计,无约束搜索有问题,约束搜索可改善性能,表明时间抽象有益,但高级搜索要与低级控制器兼容。

Comments Accepted at WM@Booth 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04464 2026-07-16 cs.LG cs.AI 版本更新 81%

Operator-on-F complements value-equivalence: a planning-time diagnostic for latent world models

算子对F补充值等价性:潜在世界模型的规划时诊断

Donna Vakalis

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.LG

AI总结 研究针对基于模型的强化学习中世界模型评估问题,引入算子对F诊断,通过模型自身预测器比较模型与环境的k步潜在前推,揭示其与规划回报的强关联及在跨架构比较中的作用,补充而非替代值等价性诊断。

Comments Accepted at RLC 2026 WM Workshop. V2 places the diagnostic in Koopman representation theory; references expanded. Results unchanged

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18223 2026-07-16 cs.CR cs.AI cs.LG cs.SY eess.SY 版本更新 81%

Learning Red Agent Policy from Observations for Neurosymbolic Autonomous Cyber Agents

从观测中学习红方代理策略用于神经符号自主网络代理

Ankita Samaddar, Sandeep Neema, Daniel Balasubramanian, Xenofon Koutsoukos

机构 * MIT(麻省理工学院)

专题命中 规划决策 :agent(title,abstract);分类 cs.AI、cs.LG

AI总结 针对网络攻击中红方动作不可观测的问题,提出基于模仿学习的策略学习技术,从网络观测和防御动作预测红方行为,集成神经符号防御代理实现高精度预测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13965 2026-07-16 cs.SE cs.CR 新提交 79%

ProfMalPlus: Agent-Coordinated Detection of Malicious NPM Packages via Static-Dynamic Analysis Synergy

ProfMalPlus:通过静态-动态分析协同实现代理协调检测恶意NPM包

Yiheng Huang, Zhijia Zhao, Bihuan Chen, Susheng Wu, Zhuotong Zhou, Yiheng Cao, Kun Hu, Xin Hu, Xin Peng

专题命中 规划决策 :agent(title,abstract);分类 cs.SE

AI总结 研究针对NPM包恶意代码检测问题,提出ProfMalPlus,结合对象敏感行为图与大语言模型推理,经多步骤提取安全切片并评估,对不确定情况增强证据后再评估,最终定位恶意代码,F1分数高且发现多个未知恶意包,性能优于现有检测器。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13054 2026-07-16 cs.RO cs.AI 新提交 79%

Autonomous UAV Route Planning for Coverage Maximization in Environmental Monitoring: A Systematic Literature Review

环境监测中用于最大化覆盖的无人机自主路径规划:一项系统文献综述

Sebastian Jouannet-Contreras, Carola Figueroa-Flores

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 该文献综述聚焦无人机环境监测的自主路径规划,遵循PRISMA 2020框架搜索相关研究。介绍筛选流程与初步分析结果,指出研究集中在特定方面,多依赖模拟验证,近期对强化学习等兴趣上升,凸显研究活跃但分散,需结构化综合以明确技术与差距。

Comments Accepted in CLEI 2026

Journal ref CLEI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06223 2026-07-16 cs.AI 版本更新 79%

From Reward-Hack Activations to Agentic Risk States: Context-Calibrated Mechanistic Monitoring in LLM Agents

从奖励黑客激活到智能体风险状态:LLM智能体中的上下文校准机制监控

Patrick Wilhelm, Odej Kao

机构 * University of Cambridge(剑桥大学)

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI

AI总结 本研究通过分析ReAct风格智能体在Gameable ALFWorld和WebShop环境中的奖励黑客行为,提出结合激活状态、熵和决策上下文的上下文校准监控方法,以更准确评估智能体风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16307 2026-07-16 cs.AI 版本更新 79%

NeSy-Route: A Neuro-Symbolic Benchmark for Constrained Route Planning in Remote Sensing

NeSy-Route:一种用于遥感约束路径规划的神经符号基准

Ming Yang, Zhi Zhou, Shi-Yu Tian, Kun-Yang Yu, Lan-Zhe Guo, Yu-Feng Li

机构 * State Key Laboratory for Novel Software Technology, Nanjing University, China(新型软件技术国家重点实验室,南京大学) School of Artifical Intelligence, Nanjing University, China(人工智能学院,南京大学) School of Intelligence Science and Technology, Nanjing University, China(智能科学与技术学院,南京大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 NeSy-Route是一个大规模神经符号基准,用于评估遥感中的约束路径规划能力,通过自动化数据生成框架和三级评估协议,全面测试多模态大语言模型的感知、推理和规划能力。

Comments Accepted by ECCV2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11811 2026-07-16 cs.RO cs.AI cs.CV 版本更新 79%

RADAR: Closed-Loop Robotic Data Generation via Semantic Planning and Autonomous Causal Environment Reset

RADAR: 通过语义规划和自主因果环境重置实现闭环机器人数据生成

Yongzhong Wang, Keyu Zhu, Yong Zhong, Liqiong Wang, Jinyu Yang, Feng Zheng

机构 * Southern University of Science and Technology(南方科技大学) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Spatialtemporal AI(时空人工智能)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 RADAR通过语义规划和自主因果环境重置实现闭环机器人数据生成,具备高适应性和可扩展性,在仿真和现实部署中均表现出卓越的性能。

Comments 8 pages, 4 figures. Accepted to the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026). Project page: https://radar-iros.netlify.app/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13818 2026-07-16 cs.RO 新提交 78%

Learning Robust Execution in Robotic Manipulation with Agentic Reinforcement Learning

通过智能强化学习在机器人操作中学习鲁棒执行

Xiaopeng Zhang, Yueyang Weng, Qi Liu, Yongjin Mu, Yanjie Li

机构 * School of Inteligence Science and Engineering, the Harbin Institute of Technology Shenzhen(哈尔滨工业大学(深圳)智能科学与工程学院) Faculty of Robot Science and Engineering, Northeastern University(东北大学机器人科学与工程学院)

专题命中 规划决策 :agentic(title,abstract)

AI总结 针对机器人操作面临的挑战,提出用两个互补指标评估执行质量,构建智能强化学习框架,通过高级决策恢复有效执行,在LIBERO基准测试中提升了执行成功率,增强了执行鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13704 2026-07-16 cs.RO 新提交 78%

nuTruck: Benchmarking Autonomous Driving Planning for Distributed Electric-drive Trucks

nuTruck:分布式电动卡车自动驾驶规划的基准测试

Jinyu Miao, Pu Zhang, Yifei He, Chengyao Zhang, Kun Jiang, Ke Wang, Mengmeng Yang, Diange Yang

机构 * School of Vehicle and Mobility, Tsinghua University(清华大学车辆与运载学院) KargoBot.AI Inc.(卡戈博特人工智能公司)

专题命中 规划决策 :planning(title,abstract)

AI总结 针对分布式电动卡车自动驾驶规划,提出nuTruck基准测试。纳入高精度动力学模型,采用多种规划器为基线,利用真实场景闭环评估,可定量评估侧翻风险等,有望成为评估此类规划器的新标准。

Comments 8 pages, 6 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13478 2026-07-16 cs.RO 新提交 78%

VAMP-MR: Vector-Accelerated Motion Planning and Execution for Multi-Robot-Arms

VAMP-MR:多机器人手臂的向量加速运动规划与执行

Philip Huang, Chenrui Gao, Jiaoyang Li

机构 * Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人研究所) University of Michigan(密歇根大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 针对多机器人手臂运动规划这一关键挑战,结合经典规划算法与矢量化碰撞检查技术,引入新运动规划器,基于CPU SIMD指令加速碰撞检查,在运动规划和执行后处理中实现加速,并发布实现降低研发门槛。

Comments 8 pages, 6 figures, 3 tables. To appear in the Proceedings of IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13403 2026-07-16 cs.RO 新提交 78%

Min-Max Regret Task Allocation and Planning of Heterogeneous Multi-Robot System in Partially Known Environments

部分已知环境中异构多机器人系统的最小-最大遗憾任务分配与规划

Xinkai Liang, Huixuan Chan, Ying Liu, Yangxi Shi, Hao Fang

专题命中 规划决策 :planning(title,abstract)

AI总结 针对部分已知环境中异构多机器人系统任务分配难题,提出基于最小-最大遗憾优化的框架,用区域绑定原子命题捕获资源不确定性,借助扩展规划决策树及新型分支定界策略,实现近线性可扩展性,性能优于基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13312 2026-07-16 cs.RO 新提交 78%

Parsimonious disturbance-aware minimum-time planning with parametric uncertainty

具有参数不确定性的简约干扰感知最短时间规划

Martino Gulisano, Matteo Masoni, Marco Gabiccini

专题命中 规划决策 :planning(title,abstract)

AI总结 研究针对赛车运动应用提出最小圈时规划框架,考虑状态干扰和参数不确定性,扩展公式并采用简约激活策略,通过MPC验证,相比无鲁棒性规划,鲁棒规划失败运行少、关键信号分散紧,提升了可跟踪性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13263 2026-07-16 math.OC 新提交 78%

An ALNS Heuristic for Large-Scale Line Planning with Mode Choice and Line Generation

一种用于具有模式选择和线路生成的大规模线路规划的自适应大邻域搜索启发式算法

Siv Marie Cartland Hansen, Richard Martin Lusby, Rowan Hoogervorst, Otto Anker Nielsen

专题命中 规划决策 :planning(title,abstract)

AI总结 针对大规模公共交通线路规划中考虑需求响应性这一复杂问题,提出可扩展的ALNS算法,联合优化线路和频率,动态生成候选线路并评估解决方案,在丹麦欧登塞网络验证其适用性,优化后提升了服务水平,凸显校准需求模型的重要性。

Comments 47 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13869 2026-07-16 physics.med-ph 新提交 78%

Direct probabilistic IMPT treatment planning with setup and range errors for neuro-oncological patients

针对神经肿瘤患者设置和范围误差的直接概率调强放疗治疗计划

Jelte R. de Jong, Sebastiaan Breedveld, Steven J. M. Habraken, Mischa S. Hoogeman, Jenneke I. de Jong, Danny Lathouwers, Zoltán Perkó

专题命中 规划决策 :planning(title,abstract)

AI总结 研究针对神经肿瘤患者,比较概率计划与稳健计划,采用基于百分位数的概率方法,通过嵌套结构和多项式混沌展开采样计算,实现更好的靶区覆盖与危及器官剂量降低权衡,优化时间有改善。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06256 2026-07-16 cs.RO 版本更新 78%

Diagnosing Semantic Handoff Failures in Agent-Orchestrated Vision-Language-Action Skill Composition

诊断智能体编排的视觉-语言-动作技能组合中的语义切换失败

Ke Rui, Yushen Zuo, Jiawei Wang, Haoran Jia, Jinming Ma, Weitao Zhou, Minglei Li

机构 * SimpleAI

专题命中 规划决策 :agent(title,abstract)

AI总结 研究智能体编排的视觉-语言-动作技能组合中的语义切换失败问题,通过智能体编排执行框架,调用基于π0.5的技能检查点,在两种初始状态分布下评估,发现单技能与长期任务成功率差距大,为未来技能库改进提供诊断依据。

Journal ref RSS SemRob Workshop 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.23270 2026-07-16 cs.RO cs.SY eess.SY 版本更新 78%

Simulation-based planning of Motion Sequences for Automated Procedure Optimization in Multi-Robot Assembly Cells

基于仿真的多机器人装配单元自动化程序优化的运动序列规划

Loris Schneider, Marc Ungen, Elias Huber, Jan-Felix Klein

机构 * Institute for Material Handling and Logistics (IFL), Karlsruhe Institute of Technology(材料搬运与物流研究所(IFL),卡尔斯鲁厄理工学院) Bosch Corporate Research, Robert Bosch GmbH(博世企业研究,罗伯特·博世有限公司)

专题命中 规划决策 :planning(title,abstract)

AI总结 提出一种基于仿真的方法,通过将装配步骤分解为核心操作和遍历操作,并采用分解式运动规划策略优化调度,以生成高效无碰撞的多机器人运动序列,减少装配时间。

Comments Accepted for publication at IEEE CASE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.17463 2026-07-16 stat.AP 版本更新 78%

A hybrid predictive and prescriptive modelling framework for long-term mental healthcare workforce planning

一种结合预测和规范性建模的长期心理健康劳动力规划框架

Harsha Chamara Hewage, Bahman Rostami-Tabar

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出了一种结合预测和规范性建模的框架,用于长期心理健康劳动力规划,通过分析库存-流量模型和概率预测,揭示当前人员计划的不可持续性并提出地区层面政策改进。

Comments Published

Journal ref Journal of the Operational Research Society (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13988 2026-07-16 cs.LG 新提交 77%

TRACE: Turn-level Reward Assignment via Credit Estimation for Long-Horizon Agents

TRACE:通过信用估计进行长期奖励分配的回合级奖励分配

Leitian Tao, Baolin Peng, Wenlin Yao, Tao Ge, Hao Cheng, Mike Hang Wang, Jianfeng Gao, Sharon Li

机构 * University of Wisconsin–Madison(威斯康星大学麦迪逊分校) Microsoft Research(微软研究院)

专题命中 规划决策 :agent(abstract);tool-use(abstract);agentic(abstract);分类 cs.LG

AI总结 研究针对多轮智能体训练后的信用分配难题,提出TRACE方法,通过特定状态转换、对数概率获取及转换等步骤进行奖励分配。该方法无需额外训练,在长期复杂搜索任务中显著提升基础模型工具使用能力,在基准测试中表现良好且学习曲线更佳。

Comments 26 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13854 2026-07-16 cs.CL 新提交 77%

SPyCE: Skill-Policy Co-evolution for Multimodal Agents

SPyCE:多模态智能体的技能-策略协同进化

Ru Zhang, Weijie Qiu

机构 * Zhejiang University(浙江大学) Beijing University of Posts and Telecommunications(北京邮电大学)

专题命中 规划决策 :tool use(abstract);tool-use(abstract);workflow(abstract);分类 cs.CL

AI总结 研究多模态智能体,提出SPyCE框架,将推理轨迹提炼为分层技能库与策略协同进化,执行技能捕获局部操作,工作流技能编码高级先验,实验证明该框架优于基线,为构建多模态智能体提供新范式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13354 2026-07-16 cs.RO 新提交 75%

A Hybrid Sampling-Based Trajectory Planner with Game-Theoretic Guidance for Autonomous Racing

一种基于混合采样的具有博弈论引导的自主赛车轨迹规划器

Alexander Langmann, Frederico Pita de Araujo, Mattia Piccinini, Johannes Betz

机构 * Professorship of Autonomous Vehicle Systems, TUM School of Engineering and Design, Technical University of Munich(慕尼黑工业大学工程与设计学院自动驾驶车辆系统教授组) Munich Institute of Robotics and Machine Intelligence (MIRMI)(慕尼黑机器人与机器智能研究所)

专题命中 规划决策 :agent(abstract);planning(abstract);multi-agent(abstract)

AI总结 针对自主赛车在多智能体场景下的规划问题,提出将博弈论推理集成到基于采样的运动规划器的混合架构,利用离线学习势函数和在线梯度优化生成交互参考路径,在模拟环境中验证该方法能诱导防御行为且无计算负担。

Comments Accepted to IEEE ITSC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏