arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-04-16 至 2026-04-16 共收录 159 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工作流自动化 23 篇

2604.13406 2026-04-16 stat.ME 50%

Leveraging machine learning to estimate individualized treatment effects in cluster-randomized trials

利用机器学习估计集群随机试验中的个体化治疗效应

Changjun Li, Xi Fang, Michael O. Harhay, Andrew B. Forbes, F. Perry Wilson, Guangyu Tong, Fan Li

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出利用混合效应机器学习方法估计集群随机试验中连续结果的条件平均治疗效应,通过整合个体和集群层面的基线协变量,解决传统方法无法捕捉个体异质性的问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13380 2026-04-16 cs.HC 50%

Does the TalkMoves Codebook Generalize to One-on-One Tutoring and Multimodal Interaction?

对话移动代码本是否能推广到一对一辅导和多模态交互?

Corina Luca Focsan, Marie Cynthia Abijuru Kamikazi, Tamisha Thompson, Jennifer St. John, Kirk Vanacore, Danielle R. Thomas, Kenneth R. Koedinger, René F. Kizilcec

专题命中 工作流自动化 :workflow(abstract)

AI总结 研究探讨TalkMoves代码本在一对一辅导中的一致性、实用性及可解释性,对比AI-人类混合代码本,发现前者在可靠性上更优,但后者在多模态覆盖和可用性上更胜一筹。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13139 2026-04-16 physics.ed-ph cond-mat.mtrl-sci 50%

Building an Affordable Self-Driving Lab: Practical Machine Learning Experiments for Physics Education Using Internet-of-Things

构建一个经济实惠的自动驾驶实验室:利用物联网进行物理教育中的实用机器学习实验

Yang Liu, Qianjie Lei, Xiaolong He, Yizhe Xue, Kexin He, Haitao Yang, Yong Wang, Xian Zhang, Li Yang, Yichun Zhou, Ruiqi Hu, Yong Xie

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出一个低成本的物联网实验平台,用于物理教育中的机器学习实践,展示深度学习在处理复杂非线性关系上的优势。

Journal ref APL Mach. Learn. 3, 046105 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00017 2026-04-16 math.GM 50%

A Ten-Face Non-Edge-Sharing Wing Set on the Regular Icosahedron and a Decagonal Equatorial Balance

正二十面体上的十面非边共享翼集及其十边形赤道平衡

YoungJune Jeon

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文研究了正二十面体上基于顶点标记N,S,U1-U5,L1-L5的十面三角翼集,通过几何构造得到十边形赤道平衡,并推导出十边形半径的闭合表达式。

Comments 8 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16130 2026-04-16 cs.NI cs.CR 50%

ZK-AMS: Credibly Anonymous Admission for Web 3.0 Platforms via Recursive Proof Aggregation

ZK-AMS:通过递归证明聚合实现Web 3.0平台可信匿名准入

Zibin Lin, Taotao Wang, Shengli Zhang, Long Shi, Boris Düdder, Shui Yu

专题命中 工作流自动化 :workflow(abstract)

AI总结 ZK-AMS通过递归证明聚合技术,实现Web 3.0平台的可信匿名准入,降低验证成本和延迟,提升高并发下的准入效率。

Comments 18 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14566 2026-04-16 cs.CV 50%

DICE: Diffusion Consensus Equilibrium for Sparse-view CT Reconstruction

DICE:扩散共识均衡用于稀疏视角CT重建

Leon Suarez-Rodriguez, Roman Jacome, Romario Gualdron-Hurtado, Ana Mantilla-Dulcey, Henry Arguello

机构 * Department of Systems and Informatics Engineering(系统与信息工程系) Department of Electrical, Electronics, and Telecommunications Engineering(电气、电子与电信工程系) Department of Physics(物理系) Universidad Industrial de Santander(圣安德烈斯工业大学)

专题命中 工作流自动化 :agent(abstract)

AI总结 DICE框架通过整合双代理共识均衡,结合生成先验能力和测量一致性,有效提升稀疏视角CT重建质量,实验显示在15、30和60视角下优于现有方法。

Comments 8 pages, 4 figures, confenrence

Journal ref Proceedings of the 2025 IEEE 10th International Workshop on Computational Advances in Multi-Sensor Adaptive Processing (CAMSAP)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 软件智能体 12 篇

2604.13282 2026-04-16 physics.med-ph 85%

Agentic MR sequence development: leveraging LLMs with MR skills for automatic physics-informed sequence development

代理MR序列开发:利用LLM与MR技能进行自动物理引导的序列开发

Moritz Zaiss, Amr Aly, Jonathan Endres, Tobias Dornstetter, Simon Weinmüller, Andreas Maier

专题命中 软件智能体 :agentic(title,abstract);agent(abstract);autonomous agent(abstract)

AI总结 本文提出Agent4MR框架,利用LLM和物理验证报告自动生成并优化PyPulseq序列,减少交互次数,实现高效序列开发。

Comments Word count abstract/body: 223 / 4303

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14234 2026-04-16 cs.CV 82%

ViBES: A Conversational Agent with Behaviorally-Intelligent 3D Virtual Body

ViBES:一个具有行为智能的3D虚拟身体对话代理

Juze Zhang, Changan Chen, Xin Chen, Heng Yu, Tiange Xiang, Ali Sartaz Khan, Shrinidhi K. Lakshmikanth, Ehsan Adeli

机构 * Stanford University(斯坦福大学) ByteDance(字节跳动)

专题命中 软件智能体 :agent(title,abstract);agentic(abstract)

AI总结 ViBES通过联合规划语言和运动,实现对话条件下的身体动作生成,提升了多轮对话中的社会交互能力。

Comments Project page: https://ai.stanford.edu/~juze/ViBES/. Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11641 2026-04-16 cs.SE cs.AI 81%

CodeTracer: Towards Traceable Agent States

CodeTracer:迈向可追溯的代理状态

Han Li, Yifan Yao, Letian Zhu, Rili Feng, Hongyi Ye, Jiaming Wang, Yancheng He, Pengyu Zou, Lehan Zhang, Xinping Lei, Haoyang Huang, Ken Deng, Ming Sun, Zhaoxiang Zhang, He Ye, Jiaheng Liu

机构 * Nanjing University(南京大学) Kuaishou Technology(快手科技) Institute of Automation, CAS(中国科学院自动化研究所) University College London(伦敦大学学院) Renmin University of China(中国人民大学) Alibaba Group(阿里巴巴集团)

专题命中 软件智能体 :agent(title,abstract);分类 cs.AI、cs.SE

AI总结 CodeTracer通过解析异构运行 artifacts,重建状态转换历史,并定位故障起始点,提升代理调试效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13927 2026-04-16 cs.PL 76%

AI Coding Agents Need Better Compiler Remarks

AI 编程代理需要更好的编译器注释

Akash Deo, Simone Campanoni, Tommy McMichen

专题命中 软件智能体 :agent(abstract);AI agent(abstract);workflow(abstract);agentic(comments)

AI总结 本文研究了编译器注释对AI代理优化程序的影响,发现精确注释能显著提升性能,而模糊注释会导致语义错误,结论是未来编译器需提供结构化反馈以支持自主性能工程。

Comments 3 pages, 1 figure, 2 tables, Presented at Workshop on Co-Design for Agentic and Multimodal AI (CoDAIM) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13109 2026-04-16 cs.SE cs.AI 76%

Applying an Agentic Coding Tool for Improving Published Algorithm Implementations

应用代理编码工具改进已发表的算法实现

Worasait Suwannik

机构 * Worasait Suwannik(独立研究者)

专题命中 软件智能体 :agentic(title);分类 cs.AI、cs.SE

AI总结 本文提出一个两阶段流程,利用AI改进已发表的算法实现。首先,大语言模型识别符合条件的算法,其次通过Claude Code重复基准并迭代改进。研究显示所有实验均取得改进,且需单日完成,同时讨论了人类在选择目标、验证实验有效性等方面不可替代的作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13107 2026-04-16 cs.SE cs.AI cs.LG 75%

Can Coding Agents Be General Agents?

编码代理可以是通用代理吗?

Maksim Ivanov, Abhijay Rana, Gokul Prabhakaran

机构 * Agentic Labs

专题命中 软件智能体 :agent(abstract);planning(abstract);分类 cs.AI、cs.LG、cs.SE

AI总结 本文探讨编码代理能否实现端到端业务流程自动化,发现其在简单任务上表现可靠,但在复杂任务上存在瓶颈,指出领域逻辑与代码执行的衔接是通用性关键障碍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13206 2026-04-16 cs.AI cs.LG cs.NA math.NA 62%

Numerical Instability and Chaos: Quantifying the Unpredictability of Large Language Models

数值不稳定性与混沌:量化大型语言模型的不可预测性

Chashi Mahiul Islam, Alan Villarreal, Mao Nishino, Shaeke Salman, Xiuwen Liu

机构 * Department of Computer Science, Florida State University, Tallahassee, USA(佛罗里达州立大学计算机科学系,塔拉希西亚,美国) Department of Mathematics, Florida State University, Tallahassee, USA(佛罗里达州立大学数学系,塔拉希西亚,美国)

专题命中 软件智能体 :agentic(abstract);分类 cs.AI、cs.LG

AI总结 本文研究了大型语言模型中数值不稳定性导致的不可预测性,揭示了浮点精度限制下误差传播机制,识别出混沌效应及三种不同行为模式。

Comments 8 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13114 2026-04-16 cs.SE cs.AI 62%

The Code Whisperer: LLM and Graph-Based AI for Smell and Vulnerability Resolution

代码低语者:结合图神经网络和大语言模型的代码和漏洞解决方法

Mohammad Baqar, Raji Rustamov, Alexander Hughes

专题命中 软件智能体 :workflow(abstract);分类 cs.AI、cs.SE

AI总结 本文提出Code Whisperer框架,结合图分析与大语言模型,统一检测和修复代码维护性和安全性问题,提升检测性能和修复建议实用性。

Comments 10 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13108 2026-04-16 cs.SE cs.AI 62%

Formal Architecture Descriptors as Navigation Primitives for AI Coding Agents

形式架构描述符作为AI编码代理的导航原语

Ruoqi Jin

机构 * Independent Researcher(独立研究者)

专题命中 软件智能体 :agent(abstract);分类 cs.AI、cs.SE

AI总结 本文研究了通过提供形式架构描述符减少AI编码代理在代码库探索中的导航开销,通过实验和观察证明了架构描述符在导航效率和错误检测方面的显著提升。

Comments 4 pages, 4 tables, preprint. Code and data: https://doi.org/10.5281/zenodo.19500105

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13102 2026-04-16 cs.SE cs.AI 62%

CCCE: A Continuous Code Calibration Engine for Autonomous Enterprise Codebase Maintenance via Knowledge Graph Traversal and Adaptive Decision Gating

CCCE:一种基于知识图谱遍历和自适应决策门控的连续代码校准引擎,用于企业代码库的自主维护

Santhosh Kusuma Kumar Parimi

机构 * Independent Researcher(独立研究员)

专题命中 软件智能体 :agentic(abstract);分类 cs.AI、cs.SE

AI总结 本文提出CCCE,通过知识图谱遍历和自适应决策门控技术,实现企业代码库的自主维护,减少修复时间并提供端到端可追溯性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29088 2026-04-16 cs.SE cs.AI 62%

WybeCoder: Verified Imperative Code Generation

WybeCoder:验证性 imperative 代码生成

Fabian Gloeckle, Mantas Baksys, Darius Feher, Kunhao Zheng, Amaury Hayat, Sean B. Holden, Gabriel Synnaeve, Peter O'Hearn

机构 * CERMICS, ENPC, Institut Polytechnique de Paris, CNRS(CERMICS,ENPC,巴黎理工学院,CNRS) Computer Lab, University of Cambridge(剑桥大学计算机实验室) Korea Institute for Advanced Study(韩国高级研究院) FAIR, Meta(FAIR,Meta) University College London(伦敦大学学院)

专题命中 软件智能体 :agentic(abstract);分类 cs.AI、cs.SE

AI总结 WybeCoder 提出了一种验证性 imperative 代码生成框架,通过证明与生成同步的方式,实现代码、不变式和证明的共同进化,提升了复杂算法的验证效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13955 2026-04-16 cs.CR cs.CY cs.SE 57%

Towards Personalizing Secure Programming Education with LLM-Injected Vulnerabilities

面向个性化安全编程教育的LLM注入漏洞方法

Matthew Frazier, Kostadin Damevski

专题命中 软件智能体 :agentic(abstract);分类 cs.SE

AI总结 本文提出利用LLM在学生代码中注入特定CWE漏洞,生成个性化教学材料,通过实验发现学生认为此类示例更相关清晰,但定量结果未显示显著差异,需进一步研究。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. GUI与网页智能体 11 篇

2604.13318 2026-04-16 cs.AI cs.CL 79%

WebXSkill: Skill Learning for Autonomous Web Agents

WebXSkill:自主网页代理的技能学习

Zhaoyang Wang, Qianhui Wu, Xuchao Zhang, Chaoyun Zhang, Wenlin Yao, Fazle Elahi Faisal, Baolin Peng, Si Qin, Suman Nath, Qingwei Lin, Chetan Bansal, Dongmei Zhang, Saravan Rajmohan, Jianfeng Gao, Huaxiu Yao

机构 * University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) Microsoft(微软)

专题命中 GUI与网页智能体 :agent(abstract);planning(abstract);workflow(abstract);分类 cs.AI、cs.CL

AI总结 WebXSkill通过可执行技能框架解决自主网页代理在长周期任务中的执行与适应问题,提升任务成功率。

Comments 21 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13654 2026-04-16 cs.RO 75%

Vision-and-Language Navigation for UAVs: Progress, Challenges, and a Research Roadmap

面向无人机的视觉与语言导航:进展、挑战与研究路线图

Hanxuan Chen, Jie Zheng, Siqi Yang, Tianle Zeng, Siwei Feng, Songsheng Cheng, Ruilong Ren, Hanzhong Guo, Shuai Yuan, Xiangyue Wang, Kangli Wang, Ji Pei

机构 * Autel Robotics, Shenzhen, China(大疆创新,深圳,中国) School of Intelligent Software and Engineering, Nanjing University, Nanjing, China(南京大学智能软件与工程学院,南京,中国) School of Computer, Data & Information Sciences, University of Wisconsin-Madison, Madison, WI, USA(威斯康星大学麦迪逊分校计算机、数据与信息科学学院,麦迪逊,WI,美国) Southern University of Science and Technology, Shenzhen, China(南方科技大学,深圳,中国) The University of Hong Kong, Hong Kong SAR, China(香港大学,香港特别行政区,中国) School of Software and Microelectronics, Peking University, Beijing, China(北京大学软件与微电子学院,北京,中国)

专题命中 GUI与网页智能体 :agent(abstract);agentic(abstract);multi-agent(abstract)

AI总结 本文综述了无人机视觉与语言导航领域,分析了从早期模块化方法到基于大模型的智能系统的发展,探讨了现实部署中的挑战,并提出了未来研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13531 2026-04-16 cs.AI cs.LG 73%

RiskWebWorld: A Realistic Interactive Benchmark for GUI Agents in E-commerce Risk Management

RiskWebWorld: 电子商务风险管理中GUI代理的现实交互基准

Renqi Chen, Zeyin Tao, Jianming Guo, Jing Wang, Zezhou Xu, Jingzhe Zhu, Qingqing Sun, Tianyi Zhang, Shuai Chen

机构 * Ant Group(蚂蚁集团)

专题命中 GUI与网页智能体 :planning(abstract);agentic(abstract);分类 cs.AI、cs.LG

AI总结 RiskWebWorld是一个用于评估GUI代理在电子商务风险管理中能力的现实交互基准,揭示了通用模型与专用模型在长周期专业任务中的显著能力差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13488 2026-04-16 cs.AI 70%

Towards Scalable Lightweight GUI Agents via Multi-role Orchestration

通过多角色编排实现可扩展的轻量级GUI代理

Ziwei Wang, Junjie Zheng, Leyang Yang, Sheng Zhou, Xiaoxuan Tang, Zhouhua Fang, Zhiwei Liu, Dajun Chen, Yong Li, Jiajun Bu

机构 * Zhejiang Key Laboratory of Accessible Perception and Intelligent Systems, Zhejiang University(浙江可及感知与智能系统重点实验室,浙江大学) College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) AntGroup(蚂蚁集团)

专题命中 GUI与网页智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文提出LAMO框架,通过多角色编排提升轻量级GUI代理的任务扩展性,开发出支持单体执行和多代理系统编排的LAMO-3B代理,结合先进规划器实现持续性能提升。

Comments Findings of ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21823 2026-04-16 cs.AI 70%

ProRe: A Proactive Reward System for GUI Agents via Reasoner-Actor Collaboration

ProRe:通过推理器-执行器协作的GUI代理前瞻性奖励系统

Gaole Dai, Shiqi Jiang, Ting Cao, Yuqing Yang, Yuanchun Li, Rui Tan, Mo Li, Lili Qiu

机构 * NTU(国立新加坡大学) Microsoft Research(微软研究院) Tsinghua University(清华大学) HKUST(香港理工大学)

专题命中 GUI与网页智能体 :agent(abstract,abstract_cn);分类 cs.AI

AI总结 ProRe通过推理器与领域特定评估器协作,提升GUI代理奖励准确性与F1分数,实验显示奖励准确性和F1分数提升达5.3%和19.4%。

Comments 23 pages, 12 figures, ICLR'2026

Journal ref The Fourteenth International Conference on Learning Representations, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08605 2026-04-16 cs.CL cs.AI 62%

ExpSeek: Self-Triggered Experience Seeking for Web Agents

ExpSeek:面向Web代理的自触发经验寻求

Wenyuan Zhang, Xinghua Zhang, Haiyang Yu, Shuaiyi Nie, Bingli Wu, Juwei Yue, Tingwen Liu, Yongbin Li

机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络安全学院) Tongyi Lab , Alibaba Group(阿里云实验室,阿里巴巴集团)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI、cs.CL

AI总结 ExpSeek通过自触发机制实现Web代理的经验主动获取,提升交互能力,实验表明其在不同规模模型上均取得显著性能提升。

Comments ACL 2026 Findings, the code is accessible at https://github.com/WYRipple/ExpSeek

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13822 2026-04-16 cs.LG 57%

UI-Copilot: Advancing Long-Horizon GUI Automation via Tool-Integrated Policy Optimization

UI-Copilot: 通过工具集成策略优化推进长周期GUI自动化

Zhengxi Lu, Fei Tang, Guangyi Liu, Kaitao Song, Xu Tan, Jin Ma, Wenqi Zhang, Weiming Lu, Jun Xiao, Yueting Zhuang, Yongliang Shen

机构 * Zhejiang University(浙江大学) Apple(苹果公司) Tencent(腾讯)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.LG

AI总结 本文提出UI-Copilot框架,通过分离持久观察与临时执行上下文实现内存解耦,结合工具集成策略优化提升长周期GUI任务性能,实验显示其在MemGUI-Bench和AndroidWorld上均优于现有模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09581 2026-04-16 cs.AI cs.CY cs.HC 57%

Avenir-UX: Automated UX Evaluation via Simulated Human Web Interaction with GUI Grounding

Avenir-UX:通过模拟人类网络交互进行自动用户体验评估

Wee Joe Tan, Zi Rui Lucas Lim, Shashank Durgad, Karim Obegi, Aiden Yiliu Li

机构 * University College London(伦敦大学学院)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI

AI总结 Avenir-UX通过模拟人类交互行为,提供标准化的可用性评估,结合GUI接地技术,提升用户体验评估的效率和准确性,支持持续、可扩展的数据驱动测试。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06477 2026-04-16 cs.AI 57%

MAS-Bench: A Unified Benchmark for Shortcut-Augmented Hybrid Mobile GUI Agents

MAS-Bench:一种统一的快捷键增强混合移动GUI代理基准测试

Pengxiang Zhao, Guangyi Liu, YaoZhen Liang, Weiqing He, Zhengxi Lu, WenHao Wang, Yuehao Huang, Yuxiang Chai, Zhaolu Kang, Yaxuan Guo, Hao Wang, Kexin Zhang, Liang Liu, Yong Liu

机构 * Zhejiang University(浙江大学) vivo AI Lab(vivo AI实验室) Peking University(北京大学)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI

AI总结 本文提出MAS-Bench,用于评估结合GUI和快捷键的混合移动自动化代理,包含139个任务和9个评估指标,实验显示混合代理在效率上优于纯GUI代理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13245 2026-04-16 cs.RO cs.SY eess.SY 50%

Capability-Aware Heterogeneous Control Barrier Functions for Decentralized Multi-Robot Safe Navigation

具备能力的异构控制屏障函数用于去中心化多机器人安全导航

Joonkyung Kim, Yanze Zhang, Wenhao Luo, Yiwei Lyu

机构 * Department of Computer Science and Engineering, Texas A&M University(德克萨斯A&M大学计算机科学与工程系) Department of Computer Science, University of Illinois Chicago(伊利诺伊大学芝加哥分校计算机科学系)

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 本文提出CA-HCBF框架,通过统一动力学模型和能力度量,实现异构机器人团队的安全一致性和能力感知协调,提升安全性和任务效率。

Comments 8 pages, 3 figures, 2 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21667 2026-04-16 cs.RO cs.CV 50%

From Instruction to Event: Sound-Triggered Mobile Manipulation

从指令到事件:基于声音的移动操作

Hao Ju, Shaofei Huang, Hongyu Li, Zihan Ding, Si Liu, Meng Wang, Zhedong Zheng

机构 * University of Macau(澳门大学) Beihang University(北航) Hefei University of Technology(合肥工业大学)

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 本文提出基于声音的移动操作方法,通过开发Habitat-Echo数据平台和任务规划器,使移动代理能主动感知并响应声音事件,无需显式指令。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 记忆与上下文管理 11 篇

2509.18847 2026-04-16 cs.CV cs.AI cs.CL 84%

Failure Makes the Agent Stronger: Enhancing Accuracy through Structured Reflection for Reliable Tool Interactions

失败让智能体更强:通过结构化反思提升准确性以实现可靠的工具交互

Junhao Su, Yuanliang Wan, Junwei Yang, Hengyu Shi, Tianyang Han, Junfeng Luo, Yurui Qiu

机构 * Vision Agent Team, Meituan(美团视觉代理团队) MeiGen AI Team, Meituan(美团MeiGen AI团队)

专题命中 记忆与上下文管理 :agent(title,abstract);tool use(abstract);分类 cs.AI、cs.CL

AI总结 本文提出结构化反思方法,通过显式反思和优化提升工具交互的可靠性,实验表明在多轮工具调用中显著提高成功率并减少冗余调用。

Comments ACL

详情

展开后加载摘要…

URL PDF HTML 收藏