arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-08-21 至 2026-08-21 共收录 162 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 9 篇

2605.10555 2026-08-21 cs.AI 版本更新 92%

Agent-First Tool API: A Semantic Interface Paradigm for Enterprise AI Agent Systems

代理优先工具API:面向企业AI代理系统的语义接口范式

Kai Pan, Rong Hou

机构 * A2A Lab(A2A实验室)

专题命中 工具调用 :agent(title,summary_cn);AI agent(title,abstract);autonomous agent(abstract);分类 cs.AI

AI总结 本文提出Agent-First Tool API范式,通过六动词语义协议、标准化工具合同和双层治理管道,解决传统API与自主代理需求的五大匹配问题,实验证明其在任务成功率、人工干预和自主纠错方面显著优于传统CRUD方法。

Comments Metadata correction: Rong Hou was inadvertently omitted from the arXiv author metadata. The author list in the manuscript already included Rong Hou. The manuscript content is unchanged

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20314 2026-08-21 cs.AI 新提交 90%

MidTool: Mid-training Data Synthesis for Agentic Tool Use

MidTool:面向智能体工具使用的训练中期数据合成

Fengqing Jiang, Yite Wang, Boyi Liu, Zhaoyang Wang, Canwen Xu, Zhewei Yao, Radha Poovendran, Yuxiong He

机构 * University of Washington(华盛顿大学) Snowflake(雪花公司) University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校)

专题命中 工具调用 :tool use(title,abstract);agentic(title,abstract);tool-use(abstract);workflow(abstract)

AI总结 本研究提出MidTool流水线,构建面向智能体工具使用的训练中期数据,在MidTool-Mix上微调Qwen3模型,可显著提升工具使用相关下游任务性能,证明通用工具使用需专门训练中期调整。

Comments Data & Model: this https URL (https://hf.co/collections/MidTool/midtool-release)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20317 2026-08-21 cs.IR 新提交 82%

Projecting BrowseComp-Plus onto ClimbMix: Toward More Realistic Corpora for Agentic Search

将BrowseComp-Plus映射到ClimbMix:构建更符合智能体搜索需求的真实语料库

Sahel Sharifymoghaddam, Lingwei Gu, Yijun Ge, Jimmy Lin

专题命中 工具调用 :agentic(title,abstract);agent(abstract)

AI总结 该研究将BrowseComp-Plus的查询映射到NVIDIA的ClimbMix语料库,构建了与基准无关的映射流水线,生成57个有效查询,使智能体搜索难度向检索环节转移,发布了相关资源。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19303 2026-08-21 cs.AI cs.CL cs.SE 新提交 75%

Outcome Monitors: Recovery Affordances for Silent Tool Failures

结果监控器:针对静默工具故障的恢复可行性

Sugam Panthi, Rabab Abdelfattah

专题命中 工具调用 :agent(abstract,abstract_cn);分类 cs.AI、cs.CL、cs.SE

AI总结 该研究针对智能体决策中的静默工具故障问题,提出结果监控器方法,可检测结果契约违反并提供恢复工具,显著提升ToolMaze和tau-bench任务的完成率。

Comments 16 pages (9 main + 7 pages supplementary material), 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00156 2026-08-21 cs.RO 版本更新 67%

Dual-Informed Vertical Expansion for Multi-Objective Node Selection in Anytime Conflict-Based Search

双信息引导的垂直扩展用于任意时间冲突搜索中的多目标节点选择

Willem van Osselaer, Jiarui Li, Meshal Alharbi, Gioele Zardini

机构 * Massachusetts Institute of Technology(麻省理工学院)

专题命中 工具调用 :agent(abstract);multi-agent(abstract)

AI总结 提出DIVE策略,通过最佳边界搜索与深度优先搜索结合,在保持最优性的同时减少搜索中断、提供早期可行解并降低内存占用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01548 2026-08-21 cs.AI cs.LG 版本更新 62%

LLM Capability Limits: Static Emergence and Dynamic Boundary Control

涌现不变性:从符号化思维到结构控制

Yi Liu

专题命中 工具调用 :tool use(abstract);分类 cs.AI、cs.LG

AI总结 该研究形式化了语言为核心的智能的限制,提出动态边界控制框架,通过DeepSeek V4-Flash实验验证其可提升大语言模型的推理性能,组织了大语言模型的涌现限制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17546 2026-08-21 cs.SE 版本更新 57%

REST API Testing with Verified LLM-Inferred Dependencies and Response-Driven Refinement

基于经验证的LLM推断依赖关系与响应驱动优化的REST API测试

Tu Nguyen, Thanh Nguyen, Huy Nguyen, Viet Nguyen, Tien N. Nguyen, Vu Nguyen

专题命中 工具调用 :workflow(abstract);分类 cs.SE

AI总结 本文提出APIPilot框架,通过执行验证LLM推断的REST API依赖关系,结合响应驱动优化,在16个真实API上实现高覆盖率与成功率,优于现有基线。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19933 2026-08-21 cond-mat.mtrl-sci 新提交 50%

Building atomistic models of heterointerfaces with optimal transport

基于最优传输构建异质界面的原子模型

Yuxuan Tang, Keith T. Butler

专题命中 工具调用 :workflow(abstract)

AI总结 本文提出融合格罗莫夫-瓦瑟斯坦(FGW)距离结合贝叶斯优化的工作流,构建异质界面原子模型,可高效筛选界面晶格匹配关系,性能优于随机搜索及预训练MACE能量引导方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16004 2026-08-21 math.FA math.CV 版本更新 50%

A proof of Esterle's conjecture on negative powers of Hilbert-space contractions

关于Hilbert空间收缩算子负幂的Esterle猜想的证明

Thomas Ransford

专题命中 工具调用 :tool use(abstract)

AI总结 本文证明了Esterle关于Hilbert空间收缩算子负幂的猜想,通过构造正序列验证了在特定条件下的算子为单位算子。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划决策 55 篇

2506.05616 2026-08-21 cs.AI cond-mat.mtrl-sci physics.comp-ph 版本更新 89%

Toward Greater Autonomy in Materials Discovery Agents: Unifying Planning, Physics, and Scientists

迈向材料发现智能体的更高自主性:统一规划、物理与科学家

Lianhao Zhou, Hongyi Ling, Keqiang Yan, Kaiji Zhao, Xiaoning Qian, Raymundo Arróyave, Xiaofeng Qian, Shuiwang Ji

机构 * Department of Computer Science and Engineering, Texas A&M University(计算机科学与工程系,德克萨斯A&M大学) Department of Materials Science and Engineering, Texas A&M University(材料科学与工程系,德克萨斯A&M大学) Department of Electrical and Computer Engineering, Texas A&M University(电气与计算机工程系,德克萨斯A&M大学) Computing and Data Sciences, Brookhaven National Laboratory(布鲁赫斯国家实验室计算与数据科学部) Department of Physics and Astronomy, Texas A&M University(物理与天文学系,德克萨斯A&M大学)

专题命中 规划决策 :planning(title,abstract);agent(abstract,abstract_cn);workflow(abstract);分类 cs.AI

AI总结 该研究提出MAPPS智能体框架,通过统一规划、物理与科学家实现更高自主性,在MP-20数据集上使材料发现相关指标提升5倍,是自主材料发现的潜力框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20087 2026-08-21 cs.RO cs.AI 新提交 83%

Towards Professional Tennis Styles for Humanoid Robots with Adaptive Motion Planning and Tracking

面向人形机器人的专业网球风格:自适应运动规划与跟踪

Tao Huang, Ruofei Liu, Xuchen Tang, Xinyin Zhang, Junli Ren, Huayi Wang, Feiyu Jia, Yukai Qi, Kangning Yin, Weishuai Zeng, Lipeng Chen, Xi Li, Ting Wu, Kailin Li, Ruoli Dai, Jingbo Wang, Lei Han, Jiangmiao Pang

机构 * Noitom Robotics(诺亦腾机器人) Shanghai AI Laboratory(上海人工智能实验室) Shanghai Jiao Tong University(上海交通大学) Dobot Robotics(越疆机器人)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本研究提出AdaPT框架,从广播视频学习专业网球风格,通过自适应机制弥合仿真到现实的差距,在Unitree G1和Dobot Atom人形机器人上验证了有效性,为相关系统提供了见解。

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20084 2026-08-21 cs.RO cs.AI 新提交 83%

Evidence-Gated Task and Motion Planning with Vision-Language Models

基于视觉语言模型的证据门控任务与运动规划

Tsunehiko Tanaka, Matthew Stephenson, Alistair Macvicar, Edgar Simo-Serra

机构 * Waseda University(早稻田大学) Flinders University(弗林德斯大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 针对机器人执行自然语言指令长时操纵任务时的部分可观测问题,提出 EAFG 框架,通过视觉证据获取与可行性门控提升食谱完成率并减少无效操纵尝试。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19880 2026-08-21 cs.AI cs.CL cs.LG 新提交 82%

EnvHarness: Awakening Static Worlds for Agent Learning

EnvHarness:为智能体学习唤醒静态环境

Chengsong Huang, Zifeng Wang, Rujun Han, Jun Yan, Yanfei Chen, Zoey CuiZhu, Ke Jiang, Peng Xia, Han Yu, Yufan Zhuang, Yifei Ming, Jiaqi Pan, Bhavana Dalvi Mishra, Jiaxin Huang, Burak Gokturk, Tomas Pfister, Chen-Yu Lee

专题命中 规划决策 :agent(title,abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 EnvHarness是包裹静态环境的可编程插件层,结合EnvRigger自动合成组件,在多领域基准测试中提升智能体学习性能,减少执行步骤并支持策略与环境协同进化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15242 2026-08-21 cs.AI cs.SE 版本更新 81%

LongRCA Bench: Diagnosing Responsible Roles and Root Causes in Long-Horizon Agent Failures

LongRCA Bench:诊断长 horizon 智能体失败中的责任角色与根本原因

Yunfei Zhang, Boyu Feng, Changhua Pei, Zexin Wang, Zhihuang Peng, Xinlong Liu, Hengyue Jiang, Difeng Ma, Jiayi Zhang, Yongzhou Yao, Yanan Zhao, Fei Sun, Yintong Huo, Zhaoyang Liu, Jingjing Li, Gaogang Xie, Dan Pei

机构 * Computer Network Information Center, Chinese Academy of Sciences(中国科学院计算机网络信息中心) Hangzhou Institute for Advanced Study, University of Chinese Academy of Sciences(中国科学院大学杭州高等研究院) Chongqing University(重庆大学) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) Singapore Management University(新加坡管理大学) Tongyi Lab, Alibaba Group(阿里巴巴集团通义实验室) Tsinghua University(清华大学)

专题命中 规划决策 :agent(title,abstract);分类 cs.AI、cs.SE

AI总结 LongRCA Bench 是含1140条失败轨迹的长 horizon 智能体失败诊断基准,本文提出无需训练的 RCTA 方法,在责任角色归因和根本步骤定位上优于现有基线,表明需将二者作为独立评估目标。

Comments 18 pages, 6 figures. Yunfei Zhang and Boyu Feng contributed equally. Changhua Pei is the corresponding author

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18637 2026-08-21 cs.IR 版本更新 80%

PILOT Technical Report

PILOT技术报告

Jiuning Lin, Ruiquan Lan, Xiaodong Zhu, Bin Zhang, Chengyu Lai, Chuxin Chen, Dimin Wang, Han Zhu, Hongtao Cheng, Jialin Zhu, Lingqing Zhang, Shuai Zhong, Tao Wang, Weipeng Huang, Yinjiang Cai, Yinnan Song, Yuan Liu, Zhibo Xiao, Zhixin Ma, Zihong Huang

专题命中 规划决策 :agent(abstract,abstract_cn);planning(abstract);agentic(abstract)

AI总结 该研究针对现有推荐系统优化智能体方法的反应式缺陷,提出PILOT框架,通过三类角色构建控制循环,在淘宝平台对比ROAM验证,实现多项指标提升且搜索效率显著提高,无需人工干预。

Comments Technical Report, 42 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20237 2026-08-21 cs.AI 新提交 79%

Rule-Compliant Visual Spatial Planning for Multimodal Large Language Models

面向多模态大语言模型的符合规则的视觉空间规划

Yu Chen, Ting Lei, Yaoyi Li, Jia Cai, Zhecen Wu, Yang Liu

机构 * Wangxuan Institute of Computer Technology, Peking University(北京大学王选计算机研究所) Yinwang Intelligent Technology Co., Ltd(银湾智能科技有限公司)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 该研究针对多模态大语言模型的规则遵循空间规划问题,构建了RuleMaze基准,提出语言-逻辑-函数混合方法和解耦多模态规划(DMP),提升了规则遵循度与规划成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19842 2026-08-21 cs.AI 新提交 79%

SAPO: Single-Rollout Autoregressive Policy Optimization for Agentic Reinforcement Learning

SAPO:用于智能体强化学习的单回滚自回归策略优化

Dayang Liang, Lang Feng, Bo An, Yunlong Liu

机构 * Xiamen University(厦门大学) Nanyang Technological University(南洋理工大学)

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI

AI总结 本研究针对智能体强化学习现有方法的三大局限,提出SAPO框架,其共享策略与价值函数的自回归主干,结合广义优势估计器,在ALFWorld、WebShop任务上性能优于PPO和GRPO,内存与计算效率更高。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15654 2026-08-21 cs.RO cs.AI 版本更新 79%

PO-PDDL: Learning Symbolic POMDPs from Visual Demonstrations for Robot Planning Under Uncertainty

PO-PDDL: 从视觉演示中学习符号化POMDP以实现不确定性下的机器人规划

Wenjing Tang, Xuanjin Jin, Yuan Liu, Renming Huang, Cewu Lu, Panpan Cai

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 提出PO-PDDL符号化POMDP框架,通过从机器人执行视频中重建潜在状态轨迹、识别部分可观测性并学习随机转移与观测模型,实现不确定性下的鲁棒任务规划。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21874 2026-08-21 cs.RO cs.AI 版本更新 79%

A Physics-Informed Neural Network Approach for UAV Path Planning in Dynamic Environments

动态环境下无人机路径规划的物理信息神经网络方法

Shuning Zhang

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 针对动态环境下无人机路径规划问题,提出PINN框架,将动力学等约束嵌入学习,仿真显示其在多指标上优于A*等传统方法,可统一模型与数据驱动规划。

Comments Withdrawn due to a substantive methodological error that affects the main conclusions of the paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20284 2026-08-21 cs.CV cs.RO 新提交 78%

Towards Surgical World-Action Modeling: A Preliminary Joint Visual-Trajectory Forecasting for Surgical Motion Planning

面向外科世界动作建模:外科手术运动规划的初步联合视觉-轨迹预测

Weiliang Huang, Huanrong Liu, Bob Zhang, Qi Dou, Zhen Chen, Yun Gu, Guy Rosman, Qingbiao Li

机构 * University of Macau(澳门大学) University of Macau Advanced Research Institute in Hengqin(澳门大学横琴研究院) The Chinese University of Hong Kong(香港中文大学) The Hong Kong Polytechnic University(香港理工大学) Shanghai Jiao Tong University(上海交通大学) Tongren Hospital(同仁医院) Duke University(杜克大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出初步联合视觉-轨迹世界动作模型,从历史手术观测中同时预测未来视觉状态与器械轨迹,采用分块自回归展开法,提升了预测性能,证明了联合预测的可行性,但仍存在长范围预测的退化与误差挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19537 2026-08-21 cs.RO 新提交 78%

Multimodal Trajectory Planning for Surface Vehicles using Turning Circle-based Control Barrier Functions

基于转向圆型控制障碍函数的水面航行器多模态轨迹规划

Changyu Lee

机构 * Kongju National University(公州国立大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文针对动态环境下自主水面航行器,提出结合MPC与TC-CBF的无引导路径多模态轨迹规划框架,可提升避碰成功率、减少安全违规并缓解局部极小问题。

Comments This work has been submitted to an Elsevier journal for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19453 2026-08-21 cs.RO cs.FL 新提交 78%

When Automata Meet Streams: Temporal Logic Compilation for Stream-Based Robotics Task and Motion Planning

自动机与流的结合:面向基于流的机器人任务与运动规划的时态逻辑编译

Sayem Nazmuz Zaman, Cyrus Neary

专题命中 规划决策 :planning(title,abstract)

AI总结 该研究提出SAM-TD方法,将LTL_f约束编译为自动机并嵌入动作模式,实现基于流的TAMP对动态生成对象的时态约束处理,在机器人环境中验证了其可行性与竞争力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16853 2026-08-21 cs.RO 版本更新 78%

FlexWorm: Primitive-augmented Hybrid Contact-motion Planning for Suction-based Multi-segment Deformable Robots

FlexWorm:用于基于吸盘的多段可变形机器人的基元增强混合接触-运动规划

Zili Tang, Tiecheng Guo, Qinyue Zhang, Meng Guo

机构 * School of Advanced Manufacturing and Robotics, Peking University(北京大学先进制造与机器人学院)

专题命中 规划决策 :planning(title,abstract)

AI总结 FlexWorm框架为基于吸盘的多段可变形机器人提出规划方法,含IKHS与PaHS,仿真和硬件实验表明其在复杂环境下规划性能更优且鲁棒性良好。

Comments 13 pages, 18 figures, accepted for publication in IEEE Robotics and Automation Letters (RA-L), 2026. Supplementary video: this https URL (https://youtu.be/OQR5Sx5Bwnc)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13854 2026-08-21 cs.CL 版本更新 77%

SPyCE: Skill-Policy Co-evolution for Multimodal Agents

SPyCE:多模态智能体的技能-策略协同进化

Ru Zhang, Weijie Qiu

机构 * Zhejiang University(浙江大学) Beijing University of Posts and Telecommunications(北京邮电大学)

专题命中 规划决策 :tool use(abstract);tool-use(abstract);workflow(abstract);分类 cs.CL

AI总结 研究多模态智能体,提出SPyCE框架,将推理轨迹提炼为分层技能库与策略协同进化,执行技能捕获局部操作,工作流技能编码高级先验,实验证明该框架优于基线,为构建多模态智能体提供新范式。

Comments Accepted by ACM MM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19794 2026-08-21 cs.AI cs.RO 新提交 74%

Towards general embodied intelligence: integrating large language models, knowledge bases, and reasoning capabilities to build the next generation of AI agents

迈向通用具身智能:整合大语言模型、知识库与推理能力以构建下一代AI智能体

Fujiang Yuan, Xia Huang, Lusheng Wang, Jun Ding, Zhen Tian, Yuxin Wang, Shaojie Gu, Yuki Funabora, Yanhong Peng, Zebing Mao

机构 * College of Mechanical Engineering, Chongqing University of Technology(重庆理工大学机械工程学院) James Watt School of Engineering, University of Glasgow(格拉斯哥大学詹姆斯·瓦特工程学院) School of Energy and Power, Jiangsu University of Science and Technology(江苏科技大学能源与动力学院) Magnesium Research Center, Kumamoto University(熊本大学镁研究中心) Department of Information and Communication Engineering, Nagoya University(名古屋大学信息与通信工程系) State Key Laboratory of Fluid Power and Mechatronic Systems, Zhejiang University(浙江大学流体动力与机电系统国家重点实验室)

专题命中 规划决策 :AI agent(title);分类 cs.AI

AI总结 本文综述以LLM为核心的智能系统演进,提出整合LLMs、KBs、RA与具身性的概念框架,明确高效LLM部署等五大挑战,为开发复杂动态环境下的自适应多模态智能体提供路线图。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20319 2026-08-21 cs.CL cs.AI 新提交 73%

Inducing Task Models from Computer-Use Traces

从计算机使用轨迹中诱导任务模型

Yucheng Jiang, Zora Zhiruo Wang, Ruishi Chen, Diyi Yang

机构 * Stanford University(斯坦福大学) Carnegie Mellon University(卡内基梅隆大学)

专题命中 规划决策 :agent(abstract);workflow(abstract);分类 cs.AI、cs.CL

AI总结 该研究提出TMI方法,可从计算机使用轨迹中分离并发任务并诱导结构化任务模型,在恢复交织任务、重构执行步骤及提升任务准确率上均优于现有基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20336 2026-08-21 cs.CV 新提交 71%

WithEveryone: Unified Planning and Identity Grounding for Group Image Generation

WithEveryone:面向群体图像生成的统一规划与身份定位

Hengyuan Xu, Qixun Wang, Yiji Cheng, Miles Yang, Zhao Zhong, Wei Cheng, Xingjun Ma, Yu-gang Jiang

机构 * Fudan University(复旦大学) Hunyuan, Tencent(腾讯混元) The University of Hong Kong(香港大学)

专题命中 规划决策 :planning(title)

AI总结 针对多人物群体图像生成的身份保留难题,提出WithEveryone框架,通过布局定位身份损失等技术,提升了人脸相似度并降低伪影,实现高身份覆盖率与低重复率。

Comments Project Page: this http URL (http://doby-xu.github.io/WithEveryone/);Code will be released: this http URL (http://github.com/Doby-Xu/WithEveryone/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19661 2026-08-21 cs.RO 新提交 71%

World-Model-Grounded LLM Planning for AUV and ASV Navigation Near Offshore Wind Farms

面向近海风电场区域自主水下航行器(AUV)与自主水面航行器(ASV)导航的世界模型赋能大语言模型规划

Markus Buchholz, Ignacio Carlucho, Yvan R. Petillot

机构 * Norwegian Defence Research Establishment (FFI)(挪威国防研究机构(FFI)) School of Engineering & Physical Sciences, Heriot-Watt University(赫瑞瓦特大学工程与物理科学学院)

专题命中 规划决策 :planning(title)

AI总结 本研究提出世界模型赋能大语言模型规划方法,结合MPC闭环重规划器等组件,在近海风电场区域的AUV和ASV导航任务中,大幅降低目标距离误差,验证了其有效性。

Comments This work has been accepted to the IEEE IROS 2026 AQ2UASIM workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20026 2026-08-21 cs.CV cs.LG 新提交 70%

From Street View Imagery to Street Quality Indicators: Vision Language Inference for the Suburban 15-minute City

从街景图像到街道质量指标:面向郊区15分钟城市的视觉语言推理

Joan Perez, Giovanni Fusco

专题命中 规划决策 :planning(abstract);workflow(abstract);分类 cs.LG

AI总结 本文以法国尼斯东北部郊区为研究对象,采用开源的SAGAI工作流,利用视觉语言模型从街景图像评估街景质量,发现理想街景仅存在于部分郊区区域,证明了VLM可支持郊区城市诊断,助力循证规划。

Comments 16 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29078 2026-08-21 cs.LG 版本更新 70%

DASH-OPD: Discrepancy-Aware Switching with Hysteresis for On-Policy Distillation

DASH-OPD:面向在线策略蒸馏的带滞后性的差异感知切换算法

Yuchen Xia, Qianguo Sun, Chao Song, Junlong Wu, Yiyan Qi, Yunjian Xu

机构 * The Chinese University of Hong Kong(香港中文大学) IDEA Research(IDEA研究院) Emdoor Research Institute(亿道研究院)

专题命中 规划决策 :agent(abstract);agentic(abstract);分类 cs.LG

AI总结 本文针对在线策略蒸馏中执行器切换的问题,提出带滞后性的差异感知切换算法 DASH-OPD,经 ALFWorld 验证,其性能优于所有基线,训练与部署效率更优,相关代码等后续将发布。

详情

展开后加载摘要…

URL PDF HTML 收藏