arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-04-13 至 2026-04-13 共收录 123 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 多智能体 19 篇

2604.08973 2026-04-13 cs.MA 88%

Multi-agent Reinforcement Learning for Low-Carbon P2P Energy Trading among Self-Interested Microgrids

多智能体强化学习用于低碳P2P能源交易中的自利微电网

Junhao Ren, Honglin Gao, Lan Zhao, Qiyu Kang, Gaoxi Xiao, Yajuan Sun

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 本文提出多智能体强化学习框架,用于自利微电网参与点对点电力交易,提升可再生能源利用率并减少高碳电力依赖,实现减排与地方繁荣的双赢。

Comments Accepted by IEEE ICC 2026, 6 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08590 2026-04-13 cs.LG cs.AI 87%

AlphaLab: Autonomous Multi-Agent Research Across Optimization Domains with Frontier LLMs

AlphaLab:利用前沿大语言模型实现跨优化领域的自主多智能体研究

Brendan R. Hogan, Xiwen Chen, James T. Wilson, Kashif Rasul, Adel Boyarsky, Thomas Kamei, Anderson Schneider, Yuriy Nevmyvaka

机构 * Morgan Stanley(摩根士丹利)

专题命中 多智能体 :agent(title);multi-agent(title);agentic(abstract);分类 cs.AI、cs.LG

AI总结 AlphaLab通过自主研究系统,利用前沿大语言模型自动完成量化计算密集型领域的完整实验流程,展示了在CUDA内核优化、LLM预训练和交通预测中的显著性能提升。

Comments 43 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09521 2026-04-13 cs.IT cs.AI math.IT 86%

Semantic Rate-Distortion for Bounded Multi-Agent Communication: Capacity-Derived Semantic Spaces and the Communication Cost of Alignment

语义率-失真:受限多智能体通信的容量导出语义空间及对齐成本

Anthony T. Nixon

专题命中 多智能体 :agent(title,abstract);multi-agent(title);分类 cs.AI

AI总结 本文研究多智能体在受限通信下的语义率-失真问题,提出基于容量导出的语义空间,并探讨通信对齐的成本与结构相变。

Comments 34 pages, 13 figures. Code: https://github.com/alch3mistdev/semantic-rate-distortion

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08802 2026-04-13 cs.LG cs.SY eess.SY 84%

Alleviating Community Fear in Disasters via Multi-Agent Actor-Critic Reinforcement Learning

通过多智能体Actor-Critic强化学习缓解灾害中的社区恐惧

Yashodhan D. Hakke, Almuatazbellah M. Boker, Lamine Mili, Michael von Spakovsky, Hoda Eldardiry

机构 * Bradley Department of Electrical and Computer Engineering, Virginia Tech(弗吉尼亚理工大学布拉德利电气与计算机工程系) Department of Mechanical Engineering, Virginia Tech(弗吉尼亚理工大学机械工程系) Department of Computer Science, Virginia Tech(弗吉尼亚理工大学计算机科学系)

专题命中 多智能体 :agent(title);multi-agent(title);分类 cs.LG

AI总结 本文提出利用多智能体Actor-Critic强化学习模型,通过整合电力、通信和应急管理三个部门的控制通道,提升灾害中社区恐惧的缓解能力,并通过飓风哈维和伊尔玛的模拟验证了方法的有效性。

Comments 10 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07956 2026-04-13 cs.AI 74%

MONETA: Multimodal Industry Classification through Geographic Information with Multi Agent Systems

MONETA:通过地理信息和多智能体系统进行多模态行业分类

Arda Yüksel, Gabriel Thiem, Susanne Walter, Patrick Felka, Gabriela Alves Werb, Ivan Habernal

机构 * Trustworthy Human Language Technologies(可信人类语言技术实验室) Technical University of Darmstadt, Germany(德国达姆施塔特工业大学) Deutsche Bundesbank(德国联邦银行) Frankfurt University of Applied Sciences, Germany(德国法兰克福应用技术大学) Research Center for Trustworthy Data Science and Security, Ruhr University Bochum, Germany(德国波鸿鲁尔大学可信数据科学与安全研究中心)

专题命中 多智能体 :agent(title);分类 cs.AI

AI总结 本文提出MONETA,首个基于文本和地理空间数据的多模态行业分类基准,利用多智能体系统提升分类精度,实现62.10%和74.10%的分类性能。

Comments Accepted to ACL 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.03353 2026-04-13 cs.MA cs.AI 70%

Decentralized Collective World Model for Emergent Communication and Coordination

去中心化的集体世界模型用于涌现通信与协调

Kentaro Nomura, Tatsuya Aoki, Tadahiro Taniguchi, Takato Horii

机构 * The University of Osaka(大阪大学) Kyoto University(京都大学) Ritsumeikan University(立命馆大学) The University of Tokyo(东京大学)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文提出一种去中心化的多智能体世界模型,通过时间扩展的集体预测编码实现通信与协调的同步发展,通过对比学习促进信息对齐,展示了在双智能体轨迹绘制任务中优于非通信模型的协调能力。

Comments Accepted at IEEE ICDL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 工作流自动化 16 篇

2604.09233 2026-04-13 eess.IV 78%

A GPU-enhanced workflow for non-Fourier SENSE reconstruction

一种增强GPU的非傅里叶SENSE重建工作流

Samuel Bianchi, Klaas P. Pruessmann

专题命中 工作流自动化 :workflow(title,abstract)

AI总结 本文提出一种基于GPU的非傅里叶SENSE重建方法,用于在复杂场景中准确重建磁共振图像,通过优化敏感性和B0映射提升重建效率和图像质量。

Comments 31 pages, 10 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11299 2026-04-13 cs.SE 57%

Automation and Reuse Practices in GitHub Actions Workflows: A Practitioner's Perspective

GitHub动作工作流中的自动化与重用实践:从业者的视角

Hassan Onsori Delicheh, Guillaume Cardoen, Alexandre Decan, Tom Mens

专题命中 工作流自动化 :workflow(abstract);分类 cs.SE

AI总结 研究从业者的GitHub动作工作流自动化与重用实践,揭示工作流开发中的优劣做法及维护支持机会,探讨核心CI/CD任务自动化倾向及可重用工作流的挑战。

Comments 38 pages. Preprint submitted to ACM Transactions on Software Engineering Methodology. Under review. Exact publication details will be provided upon acceptance

Journal ref ACM Transactions on Software Engineering and Methodology - Published 6 April 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09037 2026-04-13 cs.CV cs.CL cs.HC 57%

SiMing-Bench: Evaluating Procedural Correctness from Continuous Interactions in Clinical Skill Videos

SiMing-Bench:从连续交互评估临床技能视频中的过程正确性

Xiyang Huang, Jiawei Lin, Keying Wu, Jiaxin Huang, Kailai Yang, Renxiong Wei, Cheng zeng, Jiayi Xiang, Ziyan Kuang, Min Peng, Qianqian Xie, Sophia Ananiadou

机构 * School of Artificial Intelligence, Wuhan University(武汉大学人工智能学院) Center for Language and Information Research, Wuhan University(武汉大学语言与信息研究中心) Southwest Jiaotong University(西南交通大学) MBZUAI(穆罕默德·本·扎耶德人工智能大学) The University of Manchester(曼彻斯特大学) Zhongnan Hospital of Wuhan University(武汉大学中南医院)

专题命中 工作流自动化 :workflow(abstract);分类 cs.CL

AI总结 SiMing-Bench旨在评估多模态大语言模型在临床技能视频中通过连续交互更新过程状态的能力,通过医师标注的数据集和标准化评分标准,揭示模型在过程级判断上的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08866 2026-04-13 cs.HC cs.AI 57%

AI-Induced Human Responsibility (AIHR) in AI-Human teams

人工智能引发的人类责任(AIHR)在人工智能-人类团队中

Greg Nyilasy, Brock Bastian, Jennifer Overbeck, Abraham Ryan Ade Putra Hito

机构 * Department of Management and Marketing, Faculty of Business and Economics, the University of Melbourne(墨尔本大学商业与经济学院管理与市场营销系) School of Psychological Sciences, Faculty of Medicine, Dentistry, and Health Sciences, the University of Melbourne(墨尔本大学医学、牙科与健康科学学院心理科学系) Melbourne Business School, the University of Melbourne(墨尔本大学墨尔本商学院)

专题命中 工作流自动化 :agent(abstract);分类 cs.AI

AI总结 研究探讨了在人工智能-人类团队中,人类如何分配责任,发现人类在与AI协作时比与他人协作时更倾向于将责任归于自己,这一现象在不同危害场景中均持续存在。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08750 2026-04-13 cs.LG cs.SY eess.SY 57%

Adversarial Sensor Errors for Safe and Robust Wind Turbine Fleet Control

对抗性传感器误差用于安全且鲁棒的风力涡轮机群控制

Julian Quick, Marcus Binder Nilsen, Andreas Bechmann, Tran Nguyen Le, Pierre-Elouan Mikael Rethore

机构 * Department of Wind and Energy Systems, Technical University of Denmark(丹麦技术大学风能与能源系统系) Department of Engineering Technology and Didactics, Technical University of Denmark(丹麦技术大学工程技术及教学法系)

专题命中 工作流自动化 :agent(abstract);分类 cs.LG

AI总结 本文提出通过对抗性代理训练安全风力发电厂控制器,采用对抗性训练方法减少最坏情况性能下降,提升风力涡轮机群控制效率。

Comments Submitted to Journal of Physics: Conference Series (Torque 2026). This is the Accepted Manuscript version of an article accepted for publication in Journal of Physics: Conference Series. IOP Publishing Ltd is not responsible for any errors or omissions in this version of the manuscript or any version derived from it. This Accepted Manuscript is published under a CC BY licence

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08744 2026-04-13 physics.chem-ph cond-mat.mtrl-sci cs.LG physics.comp-ph 57%

Active Learning for Generalizable Detonation Performance Prediction of Energetic Materials

面向通用爆炸性能预测的主动学习方法研究

R. Seaton Ullberg, Megan C. Davis, Jeremy N. Schroeder, Andrew H. Salij, M. J. Cawkwell, Christopher J. Snyder, Wilton J. M. Kort-Kamp, Ivana Matanovic

机构 * Los Alamos National Laboratory(洛斯阿拉莫斯国家实验室) Texas Tech University(德克萨斯理工大学)

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 本文提出一种结合密度泛函理论、热化学建模和神经网络的主动学习策略,构建了最大的炸药数据库和可泛化预测模型,揭示氧平衡对爆炸性能的主导作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09383 2026-04-13 astro-ph.EP astro-ph.IM 50%

Nii-body: Bayesian Inference of Multiplanet Dynamics via N-body Simulations

Nii-body:通过N体模拟进行多行星动力学的贝叶斯推断

Hong-Fei Jia, Sheng Jin, Dong-Hong Wu, Shang-Fei Liu

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出Nii-body框架,结合N体积分与MCMC方法,用于多行星系统的参数推断,通过简化合成观测验证其效率和鲁棒性,适用于高精度轨道推断。

Comments Accepted for publication in Astronomical Techniques and Instruments

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.03364 2026-04-13 cs.HC 50%

DroidRetriever: A Transparent and Steerable Automation System for Collaborative Mobile Information Seeking

DroidRetriever:一种透明且可操控的协作移动信息检索自动化系统

Yiheng Bian, Yunpeng Song, Guiyu Ma, Rongrong Zhu, Zhongmin Cai

专题命中 工作流自动化 :workflow(abstract)

AI总结 DroidRetriever通过透明化和可控的自动化系统,提升移动信息检索的覆盖率和透明度,减少用户认知负担。

Comments 24 pages, 8 figures. Accepted at CHI 2026 (ACM Conference on Human Factors in Computing Systems), Barcelona, Spain, April 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09227 2026-04-13 eess.IV cs.CV 50%

Training-free, Perceptually Consistent Low-Resolution Previews with High-Resolution Image for Efficient Workflows of Diffusion Models

无需训练的感知一致低分辨率预览与高分辨率图像的高效扩散模型工作流程

Wongi Jeong, Hoigi Seo, Se Young Chun

机构 * Seoul National University(首尔国立大学)

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出无需训练的低分辨率预览生成方法,通过选择下采样矩阵和交换子零条件,实现与高分辨率图像的感知一致性,减少计算量并提升工作流程效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09153 2026-04-13 cs.CR 50%

Hagenberg Risk Management Process (Part 3): Operationalization, Probabilities, and Causal Analysis

海根伯格风险管理系统(第三部分):操作化、概率与因果分析

Eckehard Hermann, Harald Lampesberger

专题命中 工作流自动化 :workflow(abstract)

AI总结 本研究提出海根伯格风险管理系统,通过将Bowtie图转化为DAG实现概率化实时风险管理,引入Realtime Risk Studio工具实现因果分析与概率捕捉,使部分缓解风险转化为可观测、可干预的模型。

Comments 18 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09151 2026-04-13 cs.CV nlin.PS 50%

Benchmarking CNN- and Transformer-Based Models for Surgical Instrument Segmentation in Robotic-Assisted Surgery

基于机器人辅助手术的手术器械分割中CNN和Transformer模型的基准测试

Sara Ameli

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文通过SAR-RARP50数据集对比了五种深度学习模型在手术器械多类语义分割中的性能,发现DeepLabV3与SegFormer在复杂手术场景中表现优异,而Transformer架构进一步提升了泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09134 2026-04-13 cs.HC cs.GR 50%

Enhance Comprehension of Over-the-Counter Drug Instructions for the General Public and Medical Professionals through Visualization Design

通过可视化设计增强非处方药说明书的可理解性:面向一般公众和医疗专业人员

Mengjie Fan, Katrin Angerbauer, Yinchu Cheng, Yingying Yan, Xiaohan Xu, Tianfu Wang, Michael Sedlmair, Yu Yang, Liang Zhou

专题命中 工作流自动化 :workflow(abstract)

AI总结 本研究通过迭代设计过程为不同受众群体定制了两种非处方药说明书设计,实验证明其在响应时间和可用性上优于传统文本说明,同时提出了一种基于系统分类的非处方药说明书分类法,并总结了可视化设计策略的工作流程。

Journal ref Computers & Graphics, Volume 136, May 2026, 104587

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09090 2026-04-13 physics.ins-det 50%

Controlled beams of cryo-cooled protein-like nanoparticles

受控的低温蛋白质类纳米颗粒束

Jingxuan He, Karol Długołecki, Hubertus Bromberger, Amit K. Samanta, Jochen Küpper

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出了一种低温缓冲气体细胞气动透镜堆叠装置,用于生成可控的纳米颗粒束,包括低密度的孤立蛋白质,并通过强场电离与速度映像成像技术进行表征。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08676 2026-04-13 stat.ME 50%

StationarityToolkit: Comprehensive Time Series Stationarity Analysis in Python

StationarityToolkit:Python中全面的时间序列平稳性分析

Bhanu Suraj Malla, Yuqing Hu

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出StationarityToolkit,一个Python库,提供10种统计检验方法,涵盖趋势、方差和季节性,帮助用户详细诊断时间序列的平稳性问题。

Comments Submitted to Journal of Open Source Software

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19002 2026-04-13 physics.chem-ph 50%

CHAOS -- A Consistent Large-scale Database for Sigma-Profiles and Other Molecular Descriptors

CHAOS -- 一种用于σ-轮廓和其他分子描述符的大规模数据库

Dominik Gond, Justus Arweiler, Thomas Specht, Hans Hasse, Fabian Jirasek

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出CHAOS数据库,提供53091种分子的σ轮廓及其他量子化学属性,显著扩展了公开可用分子数量,并为分子和热力学性质建模提供一致基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10277 2026-04-13 physics.comp-ph physics.optics 50%

MCP-Enabled LLM for Meta-optics Inverse Design: Leveraging Differentiable Solver without LLM Expertise

基于MCP的LLM用于元光学逆向设计:无需LLM专业知识即可利用可微求解器

Yi Huang, Bowen Zheng, Yunxi Dong, Hong Tang, Huan Zhao, S. M. Rakibul Hasan Shawon, Sensong An, Hualiang Zhang

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出MCP框架,利用LLM生成逆向设计代码,通过动态访问验证代码模板和文档提升设计质量与效率,展示如何使复杂工具对非编程专家可用。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 软件智能体 5 篇

2506.04676 2026-04-13 cs.CV cs.AI cs.LG cs.MA 84%

Gen-n-Val: Agentic Image Data Generation and Validation

Gen-n-Val:代理图像数据生成与验证

Jing-En Huang, I-Sheng Fang, Tzuhsuan Huang, Yu-Lun Liu, Chih-Yu Wang, Jun-Cheng Chen

机构 * National Yang Ming Chiao Tung University(国立阳明交通大学) Research Center for Information Technology Innovation, Academia Sinica(中央研究院资讯科技创新研究中心)

专题命中 软件智能体 :agentic(title,abstract);agent(abstract);分类 cs.AI、cs.LG

AI总结 针对计算机视觉任务中数据稀缺、标签噪声和长尾类别不平衡问题,Gen-n-Val引入基于Layer Diffusion和大语言模型的代理生成框架,有效提升实例分割和目标检测的合成数据质量与性能。

Comments Accepted to the CVPR 2026 Findings track

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28013 2026-04-13 cs.CR cs.AI cs.LG 73%

Kill-Chain Canaries: Stage-Level Tracking of Prompt Injection Across Attack Surfaces and Model Safety Tiers

Kill-Chain Canaries: 阶段级跟踪跨攻击表面和模型安全层级的提示注入

Haochuan Kevin Wang, Zechen Zhang

机构 * Massachusetts Institute of Technology(麻省理工学院) University of Chicago(芝加哥大学)

专题命中 软件智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

AI总结 研究通过跟踪加密令牌四个阶段,揭示提示注入是管道-架构问题,发现写节点位置是最高安全决策,所有防御因通道不匹配失效,且隐形白字体PDF负载可匹配或超越可见文本ASR。

Comments 10 pages, 8 figures. Benchmark code and run logs released

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05744 2026-04-13 cs.CL cs.SE 73%

CodeScout: Contextual Problem Statement Enhancement for Software Agents

CodeScout: 为软件代理提供上下文化的问题陈述增强

Manan Suri, Xiangci Li, Mehdi Shojaie, Songyang Han, Chao-Chun Hsu, Shweta Garg, Aniket Anand Deshmukh, Varun Kumar

机构 * University of Maryland, College Park(马里兰大学帕克分校) Amazon Web Services (AWS)(亚马逊云服务(AWS)) Databricks

专题命中 软件智能体 :agent(abstract);agentic(abstract);分类 cs.CL、cs.SE

AI总结 CodeScout通过轻量级预探索将模糊请求转化为完整问题陈述,提升软件代理性能,实验表明其在解决率上提升20%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09409 2026-04-13 cs.SE 70%

Do AI Coding Agents Log Like Humans? An Empirical Study

AI 编程代理是否像人类一样记录日志?一项实证研究

Youssef Esseddiq Ouatiti, Mohammed Sayagh, Hao Li, Ahmed E. Hassan

专题命中 软件智能体 :agent(abstract);agentic(abstract);分类 cs.SE

AI总结 研究通过分析4550个代理拉取请求,发现代理在58.4%的仓库中更改日志频率低于人类,但日志密度更高。明确的日志指令稀缺且无效,人类在72.5%的情况下修复日志问题,表明自然语言指令存在不足,需引入确定性限制以确保一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05529 2026-04-13 cs.AI 57%

ActivityEditor: Learning to Synthesize Physically Valid Human Mobility

ActivityEditor: 学习合成物理有效的行人移动

Chenjie Yang, Yutian Jiang, Anqi Liang, Wei Qi, Chenyu Wu, Junbo Zhang

机构 * Southwest Jiaotong University(西南交通大学) HKUST (Guangzhou)(香港科技大学(广州)) Shanghai Jiao Tong University(上海交通大学) Tsinghua University(清华大学) JD Technology(京东科技)

专题命中 软件智能体 :agent(abstract);分类 cs.AI

AI总结 本文提出ActivityEditor,一种双LLM代理框架,用于零样本跨区域轨迹生成。通过意图生成代理和编辑代理协同工作,结合强化学习和物理约束,实现高保真轨迹生成。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. GUI与网页智能体 3 篇

2604.09155 2026-04-13 cs.LG cs.AI 62%

CORA: Conformal Risk-Controlled Agents for Safeguarded Mobile GUI Automation

CORA: 为保障移动GUI自动化设计的符合性风险控制代理

Yushi Feng, Junye Du, Qifan Wang, Zizhan Ma, Qian Niu, Yutaka Matsuo, Long Feng, Lequan Yu

机构 * The University of Hong Kong(香港大学) The Chinese University of Hong Kong(香港中文大学) The University of Tokyo(东京大学)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI、cs.LG

AI总结 CORA通过统计保障减少有害操作,利用Guardian模型评估行动风险并校准执行/中止边界,结合Goal-Lock机制和Phone-Harm基准验证其在自主GUI执行中的安全性与实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08883 2026-04-13 cs.RO cs.AI 57%

HTNav: A Hybrid Navigation Framework with Tiered Structure for Urban Aerial Vision-and-Language Navigation

HTNav:一种具有分层结构的混合导航框架用于城市空域视觉-语言导航

Chengjie Fan, Cong Pan, Zijian Liu, Ningzhong Liu, Jie Qin

机构 * Nanjing University of Aeronautics and Astronautics(南京航空航天大学) Key Laboratory of Brain-Machine Intelligence Technology, Ministry of Education(教育部脑机智能技术重点实验室)

专题命中 GUI与网页智能体 :planning(abstract);分类 cs.AI

AI总结 本文提出HTNav框架,结合模仿学习与强化学习,通过分层决策机制提升复杂城市环境中的导航精度与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19396 2026-04-13 cs.AI 57%

EchoTrail-GUI: Building Actionable Memory for GUI Agents via Critic-Guided Self-Exploration

EchoTrail-GUI: 通过批评者引导的自我探索构建可操作的记忆以改进GUI代理

Runze Li, Yuwen Zhai, Bo Xu, LiWu Xu, Nian Shi, Wei Zhang, Ran Lin, Liang Wang

机构 * Taobao & Tmall Group of Alibaba(阿里巴巴淘宝天猫集团) East China Normal University(华东师范大学) Shanghai Innovation Institute(上海创新研究院)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI

AI总结 本文提出EchoTrail-GUI框架,通过动态记忆系统提升GUI代理任务成功率和效率,验证了结构化记忆在GUI自动化中的有效性。

Comments CVPR 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏