arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-06-24 至 2026-06-24 共收录 49 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 49 篇

2606.24626 2026-06-24 cs.AI 新提交 87%

SAFARI: Scaling Long Horizon Agentic Fault Attribution via Active Investigation

SAFARI: 通过主动调查扩展长时域智能体故障归因

Chenyang Zhu, Jiayu Yao, Kushal Chawla, Youbing Yin, Nathan Wolfe, Pengshan Cai, Jingyu Wu, Spencer Hong, Sangwoo Cho, Shi-Xiong Zhang, Daben Liu, Sambit Sahu, Erin Babinsky

机构 * Department of Engineering Sciences(工程科学系) Applied Mathematics, Northwestern University(应用数学,西北大学)

专题命中 规划决策 :agentic(title,abstract);agent(abstract);autonomous agent(abstract);multi-agent(abstract)

AI总结 提出SAFARI框架,用工具增强的诊断循环替代线性上下文加载,结合短期记忆解耦诊断准确性与上下文限制,在Who&When和TRAIL GAIA数据集上分别提升20%和19%,并在超出上下文窗口5倍时保持0.58精度。

Comments Published at the Second Workshop on Agents in the Wild: Safety, Security, and Beyond (AIWILD) at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23991 2026-06-24 cs.AI cs.LG cs.MA cs.RO 新提交 86%

Critique of Agent Model

智能体模型批判

Eric Xing, Mingkai Deng, Jinyu Hou

机构 * Institute of Foundation Models, Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学基础模型研究所) School of Computer Science, Carnegie Mellon University(卡内基梅隆大学计算机科学学院)

专题命中 规划决策 :agent(title,abstract);AI agent(abstract);agentic(abstract);分类 cs.AI、cs.LG

AI总结 本文区分了自动化与智能体,提出真正智能体需内化目标、身份、决策、自我调节和学习等结构,并设计了GIC通用智能体架构。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03476 2026-06-24 cs.LG cs.AI cs.MA cs.NA math.NA physics.comp-ph 版本更新 81%

ATHENA: Agentic Team for Hierarchical Evolutionary Numerical Algorithms

ATHENA:分层进化数值算法的智能团队

Juan Diego Toscano, Daniel T. Chen, George Em Karniadakis

机构 * Division of Applied Mathematics, Brown University(布朗大学应用数学系)

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI、cs.LG

AI总结 ATHENA通过知识驱动的诊断流程,实现科学计算与科学机器学习的自动化,结合专家蓝图和组合空间,生成高精度数值解和稳定求解器,达到10^-14的验证误差。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24526 2026-06-24 cs.CL 新提交 79%

AGORA: An Archive-Grounded Benchmark for Agentic Workplace Document Reasoning

AGORA:基于档案的智能体工作场所文档推理基准

Honglin Guo, Qi Zhang, Yu Zhang, Weijie Li, Rui Zheng, Zhikai Lei, Qiyuan Peng, Zhiheng Xi, Tao Gui, Qi Zhang

机构 * Fudan University(复旦大学) Zhejiang University(浙江大学) Shanghai Qiji Zhifeng Co., Ltd.(上海奇绩智峰有限公司)

专题命中 规划决策 :agentic(title,abstract);分类 cs.CL

AI总结 提出AGORA基准,包含362个问题、8个领域共9664份真实文档(3.72亿词元),要求智能体在超大档案中主动搜索稀疏证据并推理答案,最强模型准确率仅59.4%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24231 2026-06-24 cs.AI 新提交 79%

FlowR2A: Learning Reward-to-Action Distribution for Multimodal Driving Planning

FlowR2A: 学习奖励到动作分布用于多模态驾驶规划

Xirui Li, Zhe Liu, Xiaoqing Ye, Wenhua Han, Yifeng Pan, Junyu Han, Hengshuang Zhao

机构 * The University of Hong Kong(香港大学) Changan Automobile(长安汽车)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 提出FlowR2A,通过流匹配解码器学习奖励条件动作分布,统一了基于评分和基于锚点的方法,实现密集监督与动态生成,在NAVSIM基准上取得最优结果。

Comments Project page: https://lixirui142.github.io/flowr2a-ad

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24184 2026-06-24 cs.LG 新提交 79%

Project Ariadne: Prompt-Conditioned Route Generation for Synthesis Planning

Project Ariadne: 用于合成规划的提示条件路线生成

Anton Morgunov, Victor S. Batista

机构 * Yale University(耶鲁大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.LG

AI总结 提出解码器专用路线生成器Ariadne,通过提示-补全序列统一表示目标、约束和路线,在RetroCast/PaRoutes基准上,深度约束和所需叶子约束的Solv-0分别提升13.7和31.2点,推理时间远低于DESP。

Comments Code is available at https://github.com/ischemist/project-ariadne

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23927 2026-06-24 cs.AI 新提交 79%

RIFT-Bench: Dynamic Red-teaming For Agentic AI Systems

RIFT-Bench:面向智能体AI系统的动态红队测试

Yarin Yerushalmi Levi, Roy Betser, Amit Giloni, Lidor Erez, Itay Gershon, Oren Rachmil, Sindhu Padakandla, Roman Vainshtein

机构 * Fujitsu Research of Europe (FRE)(富士通欧洲研究院) Fujitsu Research of India Pvt. Ltd. (FRIPL)(富士通印度私人研究有限公司)

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI

AI总结 提出RIFT-Bench,一种基于图表示的动态红队测试方法,用于统一评估异构智能体AI系统的安全性,通过自动发现系统结构并部署自适应对抗攻击。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00618 2026-06-24 cs.AI 版本更新 79%

Efficient Test-time Inference for Generative Planning Models with OCL Search

生成式规划模型的高效测试时推理

Robert Gieselmann, Mihai Samson, Federico Pecora, Jeremy L. Wyatt

机构 * University of California, Berkeley(加州大学伯克利分校) ETH Zurich(苏黎世联邦理工学院)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本文提出一种改进的开放-封闭列表搜索算法,结合生成模型和启发式模型,在测试时高效推理,提升生成式规划模型的解质量和计算效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.17070 2026-06-24 cs.RO cs.AI 版本更新 79%

MuTRAP: Multi-trigger Trojans Attacking Robot Task Planning Systems

MuTRAP: 攻击机器人任务规划系统的多触发器木马

Mohaiminul Al Nahian, Zainab Altaweel, David Reitano, Sabbir Ahmed, Shiqi Zhang, Adnan Siraj Rakin

机构 * Binghamton University (SUNY)(宾夕法尼亚州立大学布林顿分校)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 提出首个针对LLM辅助机器人任务规划器的多触发器木马攻击MuTRAP,通过少量任务特定参数注入后门,并优化触发器词以激活特定恶意行为,揭示当前基于LLM的规划器的安全漏洞。

Comments Accepted for publication at the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.06138 2026-06-24 cs.MM cs.AI cs.HC 版本更新 79%

Multimedia and Visual Analytics in the Agentic Era

代理时代的多媒体与可视化分析

Marcel Worring, Jan Zahálka, Stef van den Elzen, Maximilian T. Fischer, Daniel A. Keim

机构 * University of Amsterdam(阿姆斯特丹大学) Czech Technical University in Prague(布拉格捷克技术大学) Eindhoven University of Technology(埃因霍温理工大学)

专题命中 规划决策 :agentic(title);AI agent(abstract);分类 cs.AI

AI总结 本文提出一个框架,将多媒体与可视化分析结合,以支持专业用户从大规模多媒体集合中获取可操作见解,实现人类与AI的真正协作。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24631 2026-06-24 cs.RO 新提交 78%

Optimization-based Safe Trajectory Planning for Autonomous Ground Vehicle in Multi-Floor Scenarios

基于优化的多楼层场景自动驾驶地面车辆安全轨迹规划

Zishang Xiang, Runda Zhang, Runqi Chai, Kaiyuan Chen, Senchun Chai, Yuanqing Xia

机构 * Beijing Institute of Technology(北京理工大学) Tsinghua University(清华大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 提出一种针对多楼层场景的轨迹规划框架,包括基于广义Voronoi图和多目标算法的任务规划模块,以及采用优化方法和热启动分层规划生成高质量轨迹的轨迹规划模块,并通过仿真验证可行性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24101 2026-06-24 cs.RO cs.CV 新提交 78%

NavWM: A Unified Navigation World Model for Foresight-Driven Planning

NavWM:一种用于前瞻性规划的统一导航世界模型

Yanghong Mei, Longteng Guo, Ming-Ming Yu, Guiyu Zhao, Xingjian He, Jing Liu

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Beihang University(北京航空航天大学) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)

专题命中 规划决策 :planning(title);agent(abstract)

AI总结 提出NavWM统一导航世界模型,通过潜在世界令牌提取几何与语义先验,结合锚点多模态轨迹预测框架生成多样化动作空间,利用视觉前瞻评估最优路径,在多种机器人数据集上显著提升未来状态生成与零样本导航成功率。

Comments 13 pages, 5 figures, accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24094 2026-06-24 cs.CV 新提交 78%

Universal Guideline-Driven Image Clustering via a Hybrid LLM Agent

通用指南驱动图像聚类:基于混合LLM代理

Wenliang Zhong, Rob Barton, Lucas Goncalves, Kushal Kumar, Feng Jiang, Hehuan Ma, Yuzhi Guo, Vidit Bansal, Karim Bouyarmane, Junzhou Huang

机构 * The University of Texas at Arlington(德克萨斯大学阿灵顿分校) Amazon(亚马逊)

专题命中 规划决策 :agent(title,abstract)

AI总结 提出首个通用图像聚类框架,通过文本指南弥合任务差异,利用生成式概念代理建模和基于最小生成树的LLM遍历,在多种聚类场景中超越专用方法。

Comments CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23937 2026-06-24 cs.CL cs.AI cs.LG 新提交 78%

When Retrieval Metrics Mislead: Measuring Policy Signal in Long-Horizon Tool-Use Agents

当检索指标误导:衡量长周期工具使用智能体中的策略信号

Tianyu Ding, Juan Pablo De la Cruz Weinstein

机构 * Amazon Web Services(亚马逊云服务)

专题命中 规划决策 :tool-use(title);分类 cs.AI、cs.CL、cs.LG

AI总结 研究发现精确匹配的检索召回率会低估下游策略效用,通过分类器实验表明检索到的策略子句与黄金子句在宏F1上无显著差异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21543 2026-06-24 cs.RO 版本更新 78%

Self-CriTeach: LLM Self-Teaching and Self-Critiquing for Improving Robotic Planning via Automated Domain Generation

Self-CriTeach: LLM 自我教学与自我批评用于通过自动领域生成提升机器人规划

Jinbang Huang, Zhiyuan Li, Yuanzhao Hu, Zhanguang Zhang, Mark Coates, Xingyue Quan, Yingxue Zhang

机构 * Huawei Noah's Ark Lab(华为诺亚实验室) University of Toronto(多伦多大学) University of British Columbia(不列颠哥伦比亚大学) McGill University(麦吉尔大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出Self-CriTeach框架,通过LLM自动生成符号规划领域,用于自我教学生成规划问题-计划对及自我批评生成结构化奖励信号,提升机器人规划性能与泛化能力。

Comments International Conference on Machine Learning (ICML) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23586 2026-06-24 math.OC cs.SY eess.SY 版本更新 78%

From Zonal to Nodal Capacity Expansion Planning: Spatial Aggregation Impacts on a Realistic Test-Case

从分区到节点容量扩展规划:空间聚合对实际测试案例的影响

Elizabeth Glista, Bernard Knueven, Jean-Paul Watson

专题命中 规划决策 :planning(title,abstract)

AI总结 本文通过加州8000+节点实际电网测试,发现精细空间聚合可近似节点规划,但粗分区模型会导致投资决策严重失真(容量投资不足高达41%)。

Comments 10 pages, 4 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23997 2026-06-24 cs.IR 新提交 75%

ChartWalker: Benchmarking the Cross-Chart RAG Task with Hierarchical Knowledge Graphs

ChartWalker: 跨图表RAG任务的基准测试

Ning Tang, Chenghan Xie, Hanyang Yuan, Yi Li, Renhong Huang, Qian Kou, Xiaofeng Shi, Hua Zhou, Jiarong Xu

专题命中 规划决策 :agent(abstract,abstract_cn);agentic(abstract)

AI总结 提出ChartWalker框架,通过层次化知识图谱和结构感知采样生成跨图表RAG基准,揭示现有方法性能差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24842 2026-06-24 cs.AI 新提交 70%

World Models in Pieces: Structural Certification for General Agents

分片世界模型:通用智能体的结构化认证

Yikai Lu, Yifei Wu, Xinyu Lu, Tongxin Li

机构 * School of Data Science, The Chinese University of Hong Kong, Shenzhen, Shenzhen, China(香港中文大学(深圳)数据科学学院)

专题命中 规划决策 :agent(abstract);planning(abstract);分类 cs.AI

AI总结 针对通用智能体在大世界场景下无法普遍胜任的问题,提出结构化认证框架,通过深度组合目标过滤特定转移,证明世界模型具有O(1/n)+O(δ)误差界,实现可认证部署。

Comments 30 pages, camera-ready version in ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24470 2026-06-24 cs.AI 新提交 70%

The Latent Bridge: A Continuous Slow-Fast Channel for Real-Time Game Agents

潜在桥:用于实时游戏智能体的连续慢-快通道

Bojie Li, Noah Shi

机构 * Pine AI University of Washington(华盛顿大学)

专题命中 规划决策 :agent(abstract);planning(abstract);分类 cs.AI

AI总结 针对实时游戏智能体,提出一种可学习的连续潜在桥(Latent Bridge),将慢速推理VLM的残差投影到快速反应VLM的输入嵌入空间,在7个Atari游戏和驾驶域中匹配或超越文本桥,且增益高度可预测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24437 2026-06-24 cs.AI 新提交 70%

ReM-MoA: Reasoning Memory Sustains Mixture-of-Agents Scaling

ReM-MoA:推理记忆维持混合代理的扩展

Heng Ping, Arijit Bhattacharjee, Peiyu Zhang, Shixuan Li, Wei Yang, Ali Jannesari, Nesreen Ahmed, Paul Bogdan

机构 * University of Southern California(南加州大学) Iowa State University(爱荷华州立大学) Cisco AI Research(思科人工智能研究院)

专题命中 规划决策 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 提出ReM-MoA框架,通过排名推理记忆和策展多样化记忆路由机制,解决混合代理架构随深度增加性能退化问题,在多个推理基准上持续优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23768 2026-06-24 cs.CR cs.AI cs.LO 新提交 70%

Cryptographic certificates of validity for trustworthy AI

可信AI的密码学有效性证书

Murdoch J. Gabbay

机构 * Heriot-Watt University(赫瑞思-瓦特大学)

专题命中 规划决策 :agent(abstract);agentic(abstract);分类 cs.AI

AI总结 提出为智能AI系统生成密码学有效性证书,通过将正确性条件编译为多项式约束的见证检查问题,并使用简洁密码学证明系统(可选零知识)来证明条件成立,平衡了源代码形式验证与密码学认证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24402 2026-06-24 cs.CR 新提交 67%

Poisoned Playbooks: Demystifying Knowledge Poisoning Effects on AI Security Agents

有毒剧本:揭秘知识投毒对AI安全代理的影响

Juho Park, Hyunmin Choi, Kevin Nam

专题命中 规划决策 :agent(abstract);AI agent(abstract)

AI总结 研究揭示通过RAG注入单条有毒安全知识可系统性改变AI安全代理行为,提出验证边界(VB)分类法,并评估验证提示与多源检索的防御效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24338 2026-06-24 cs.RO 新提交 67%

RoBoSR: Structured Scene Representations for Embodied Robotic Reasoning

RoBoSR:面向具身机器人推理的结构化场景表示

Kewei Hu, Wanchan Yu, Fangwen Chen, Jing Jiajian, Zimeng Li, Ying Wei, Tianhao Liu, Michael Zhang, Hanwen Kang

专题命中 规划决策 :agent(abstract);planning(abstract)

AI总结 提出RoBoSR,一种基于语义对象中心场景图的中间结构表示,将操作建模为逐步状态转换,实现因果推理和长期任务规划,并在零样本泛化中优于提示方法和经典TAMP基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23745 2026-06-24 q-bio.BM cs.AI cs.LG 新提交 62%

JEDEL: Zero-Shot DNA-Encoded Library Design for Early-Stage Drug Discovery

JEDEL:用于早期药物发现的零样本DNA编码库设计

Zygimantas Jocys, Zhanxing Zhu, Henriette M. G. Willems, Katayoun Farrahi

机构 * The ALBORADA Drug Discovery Institute, University of Cambridge(剑桥大学ALBORADA药物发现研究所)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 提出JEDEL框架,直接从活性配体的三维药效团表示生成可合成的DNA编码库,无需目标特异性再训练,在18个蛋白靶点上优于随机和多样性基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24047 2026-06-24 cs.AI cs.LG 新提交 62%

Ensemble Feature Selection and Harris Hawks Optimization for Explainable Mental Health Risk Prediction in Female Sex Workers

集成特征选择与哈里斯鹰优化用于女性性工作者可解释心理健康风险预测

Ahnaf Atef Choudhury, Md. Parvej Hoque Palash, Shahriar Siddique Ayon, Ramkrishna Saha, Abdullah Al Mamun

机构 * Department of Information Sciences and Technology(信息科学与技术系) George Mason University(乔治·马歇尔大学) Department of Computer Science and Engineering(计算机科学与工程系) Jahangirnagar University(贾汗吉尔纳加尔大学) AIUB The University of Texas at Dallas(德克萨斯大学达拉斯分校) Dhaka University of Engineering and Technology(达卡工程与技术大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 提出集成ANOVA和互信息的特征选择与哈里斯鹰优化逻辑回归的混合模型,在3005名女性性工作者中实现95.78%准确率,识别创伤后应激、客户暴力和职业因素为抑郁主要贡献因素。

Comments Accepted and presented at the 2026 8th IEEE Symposium on Computers & Informatics (ISCI 2026). To appear in IEEE conference proceedings

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23995 2026-06-24 cs.LG cs.AI cs.GT cs.MA 新提交 62%

EMAgnet: Parameter-Space EMA Regularization for Policy Gradient Self-Play in Large Games

EMAgnet:大规模博弈中策略梯度自我博弈的参数空间EMA正则化

Tristan Maidment, JB Lanier, Chase McDonald, Nathan Tsang, Eugene Vinitsky, Roy Fox, Albert Wang, Wesley N. Kerr

机构 * Riot Games(拳头游戏) University of California, Irvine(加州大学尔湾分校) New York University(纽约大学)

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.LG

AI总结 提出EMAgnet,通过指数移动平均(EMA)对策略参数进行自适应正则化,替代均匀分布正则化,在两人零和博弈中降低可剥削性。

Comments Accepted at NExT-Game 2026: New Frontiers in Game-Theoretic Learning (ICML 2026 Workshop). 13 pages, 2 figures,

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23938 2026-06-24 cs.AI cs.CL 新提交 62%

Neuro-Symbolic Drive: Rule-Grounded Faithful Reasoning for Driving VLAs

神经符号驱动:基于规则忠实推理的驾驶VLA

Xiangbo Gao, Xiukun Huang, Boyu Lu, Junge Zhang, Mengjie Mao, Jiachen Li, Wei Xiong, Zhengzhong Tu

机构 * Texas A&M University(德克萨斯农工大学) Carnegie Mellon University(卡内基梅隆大学) University of Maryland(马里兰大学) University of California, Riverside(加利福尼亚大学河滨分校) University of Pittsburgh(匹兹堡大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.CL

AI总结 提出神经符号驱动框架,利用规则规划器的决策轨迹监督驾驶VLA,实现推理与运动生成的因果耦合,显著降低轨迹误差和碰撞率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15067 2026-06-24 cs.LG cs.AI cs.SY eess.SY 版本更新 62%

EMFusion: Uncertainty-Aware Conditional Diffusion Model for Multivariate Narrow-band Exposure Forecasting

EMFusion: 一种考虑不确定性的条件扩散框架用于无线网络中频率选择性电磁场预测

Zijiang Yan, Yixiang Huang, Jianhua Pei, Hina Tabassum, Luca Chiaraviglio

机构 * department of Electrical Engineering and Computer Science, York University(电气工程与计算机科学系,约克大学) School of Electrical and Electronic Engineering, Huazhong University of Science and Technology(电子与电气工程学院,华中科技大学) Central China Branch of State Grid Corporation of China(国家电网公司中部分部) Department of Electronic Engineering, University of Rome Tor Vergata(罗马大学Tor Vergata电子工程系) Consorzio Nazionale Interuniversitario per le Telecomunicazioni (CNIT)(国家大学间电信研究会(CNIT))

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出EMFusion框架,通过整合时间、季节等上下文因素,提供不确定性估计,以提升无线网络中频率选择性电磁场预测的准确性。

Comments Accepted in IEEE Transactions on Network Science and Engineering

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24669 2026-06-24 cs.AI 新提交 61%

LaGO: Latent Action Guidance for Online Reinforcement Learning

LaGO:面向在线强化学习的潜在动作引导

Kuan-Yen Liu, Ren-Jyun Huang, Ti-Rong Wu

机构 * Siebel School of Computing(计算科学系) Data Science, University of Illinois Urbana-Champaign, USA(数据科学,伊利诺伊大学厄巴纳-香槟分校,美国) Department of Computer Science, National Yang Ming Chiao Tung University, Taiwan(计算机科学系,National Yang Ming Chiao Tung大学,台湾) Institute of Information Science, Academia Sinica, Taiwan(信息科学研究所, Academia Sinica,台湾)

专题命中 规划决策 :planning(abstract,comments);分类 cs.AI

AI总结 提出LaGO框架,利用预训练大语言模型作为潜在动作先验,软引导在线策略优化,在离散和连续控制基准上显著提升奖励与成功率。

Comments 9 pages, 2 figures. Accepted at the ICML 2026 Workshop on Large Language Models for Planning (LM4Plan)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24483 2026-06-24 eess.SP cs.AI 新提交 57%

Adaptive Machine Learning Framework for UAV Trajectory Optimization in O-RAN

面向O-RAN的无人机轨迹优化自适应机器学习框架

Chenrui Sun, Swarna Bindu Chetty, Gianluca Fontanesi, Mahnaz Arvaneh, Walid Saad, Hamed Ahmadi

机构 * school of Physics, Engineering and Technology, University of York(物理、工程与技术学院,约克大学) Radio Systems Research, Nokia Bell Labs(诺基亚贝尔实验室无线电系统研究部) School of Electrical and Electronic Engineering, University of Sheffield(电子与电气工程学院,谢菲尔德大学) Bradley Department of Electrical and Computer Engineering, Virginia Tech(布拉德利电气与计算机工程系,弗吉尼亚理工学院)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 提出一种集成增强持续迁移学习的无人机轨迹优化框架,通过模型选择机制从预训练库中迁移知识,减少适应时间,仿真表明收敛时间减少44%-56%。

Comments 16 pages, 12 figures, IEEE Transactions on Vehicular Technology

Journal ref 2026 IEEE Transactions on Vehicular Technology

详情

展开后加载摘要…

URL PDF HTML 收藏