arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-04-22 至 2026-04-22 共收录 17 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 17 篇

2604.18612 2026-04-22 cs.NE cs.AI cs.LG 90%

Agent-GWO: Collaborative Agents for Dynamic Prompt Optimization in Large Language Models

Agent-GWO: 为大型语言模型的动态提示优化设计的协作代理

Xudong Wang, Chaoning Zhang, Chenghao Li, Shuxu Chen, Qigan Sun, Jiaquan Zhang, Fachrina Dewi Puspitasari, Tae-Ho Kim, Jiwei Wei, Malu Zhang, Guoqing Wang, Yang Yang, Heng Tao Shen

机构 * Kyung Hee University(韩国庆熙大学) University of Electronic Science and Technology of China(电子科技大学) Nota Inc.(Nota公司) Tongji University(同济大学)

专题命中 工具调用 :agent(title,title_cn);分类 cs.AI、cs.LG

AI总结 本文提出Agent-GWO框架,通过统一提示模板和解码超参数作为可继承的代理配置,利用灰狼优化器的领导者-追随者机制,自动选择领导者代理以指导协作更新,提升复杂推理的准确性和稳定性。

Comments Accepted to ACL 2026. 9 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19026 2026-04-22 cs.MA cs.CR 90%

ClawCoin: An Agentic AI-Native Cryptocurrency for Decentralized Agent Economies

ClawCoin:一种去中心化智能体经济中的代理原生加密货币

Shaoyu Li, Chaoyu Zhang, Hexuan Yu, Y. Thomas Hou, Wenjing Lou

专题命中 工具调用 :agent(title,abstract);agentic(title);AI agent(abstract);workflow(abstract)

AI总结 ClawCoin通过计算成本索引的账本资产,解决代理经济中计算成本不可转移的问题,提升去中心化智能体协调能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18296 2026-04-22 cs.CL cs.AI cs.LG 88%

Temp-R1: A Unified Autonomous Agent for Complex Temporal KGQA via Reverse Curriculum Reinforcement Learning

Temp-R1:通过反向课程强化学习实现复杂时间知识图谱问答的统一自主代理

Zhaoyan Gong, Zhiqiang Liu, Songze Li, Xiaoke Guo, Yuanxiang Liu, Xinle Deng, Zhizhen Liu, Lei Liang, Huajun Chen, Wen Zhang

机构 * Zhejiang University(浙江大学) Ant Group(蚂蚁集团) ZJU-Ant Group Joint Lab of Knowledge Graph(浙江大学-蚂蚁集团知识图谱联合实验室)

专题命中 工具调用 :agent(title,abstract);autonomous agent(title);分类 cs.AI、cs.CL、cs.LG

AI总结 本文提出Temp-R1,首个通过强化学习训练的时间知识图谱问答自主代理,通过扩展动作空间和反向课程学习提升复杂问题的推理能力,在MultiTQ和TimelineKGQA上取得最佳性能。

Comments ACL 2026 main

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12258 2026-04-22 cs.CL cs.AI 86%

Coding-Free and Privacy-Preserving Agentic Framework for Data-Driven Clinical Research

无编码且隐私保护的代理框架用于数据驱动的临床研究

Taehun Kim, Hyeryun Park, Hyeonhoon Lee, Yushin Lee, Kyungsang Kim, Hyung-Chul Lee

机构 * Infmedix, Co., Ltd.(Infmedix公司) Department of Transdisciplinary Studies, Seoul National University(首尔国立大学跨学科研究系) Healthcare AI Research Institute, Seoul National University Hospital(首尔国立大学医院医疗人工智能研究所) Department of Medicine, Seoul National University College of Medicine(首尔国立大学医学院医学系) Department of Transdisciplinary Medicine, Seoul National University Hospital(首尔国立大学医院跨学科医学系) Department of Radiology, Massachusetts General Hospital and Harvard Medical School(麻省总医院放射科及哈佛医学院)

专题命中 工具调用 :agentic(title,abstract);planning(abstract);workflow(abstract);分类 cs.AI、cs.CL

AI总结 本文提出CARIS框架,通过整合大语言模型与模块化工具,实现无需编程的自然语言驱动研究,提升临床研究效率与隐私保护。

Comments 10 pages, 5 figures, 2 tables, Supplementary Appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.06922 2026-04-22 cs.CR cs.LG 83%

Whispers in the Machine: Confidentiality in Agentic Systems

机器中的低语:代理系统中的保密性

Jonathan Evertz, Merlin Chlosta, Lea Schönherr, Thorsten Eisenhofer

机构 * CISPA Helmholtz Center for Information Security(信息安全勒内希特中心)

专题命中 工具调用 :agentic(title,abstract);agent(abstract);分类 cs.LG

AI总结 研究探讨了基于大语言模型的代理系统中的保密性问题,通过抽象敏感数据为秘密字符串,评估了十种代理在20种工具场景和14种攻击策略下的安全性,发现所有代理均存在至少一种漏洞,现有防御措施无法有效防止数据泄露。

Comments Accepted at Conference on Detection of Intrusions and Malware & Vulnerability Assessment (DIMVA) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18874 2026-04-22 cs.AI 79%

How Adversarial Environments Mislead Agentic AI?

对抗性环境如何误导代理AI?

Zhonghao Zhan, Huichi Zhou, Zhenhao Li, Peiyuan Jing, Krinos Li, Hamed Haddadi

机构 * Imperial College London(伦敦帝国学院)

专题命中 工具调用 :agentic(title);agent(abstract);分类 cs.AI

AI总结 研究指出代理AI在依赖外部工具时存在信任缺口,提出对抗性环境注入威胁模型,通过POTEMKIN协议测试发现,对抗性攻击导致代理在知识和导航鲁棒性上存在差异。

Comments Accepted to Findings of the Association for Computational Linguistics: ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18718 2026-04-22 cs.CR cs.AI 79%

Towards Optimal Agentic Architectures for Offensive Security Tasks

迈向进攻性安全任务的最优代理架构

Isaac David, Arthur Gervais

机构 * University College London(伦敦大学学院)

专题命中 工具调用 :agentic(title,abstract);分类 cs.AI

AI总结 本文通过控制基准测试评估不同代理架构在进攻性安全任务中的性能,发现白盒模式和Web目标在检测效率上显著优于黑盒模式和二进制目标,且更广泛的协调能提升覆盖范围但需权衡成本与验证难度。

Comments 18 pages, 4 figures, supplementary appendix and benchmark artifacts

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.23281 2026-04-22 cs.CL 74%

MCP vs RAG vs NLWeb vs HTML: A Comparison of the Effectiveness and Efficiency of Different Agent Interfaces to the Web (Technical Report)

MCP与RAG与NLWeb与HTML:不同网页代理接口的有效性和效率比较(技术报告)

Aaron Steiner, Ralph Peeters, Christian Bizer

机构 * Data and Web Science Group(数据与网络科学组) University of Mannheim(曼海姆大学)

专题命中 工具调用 :agent(title);分类 cs.CL

AI总结 本文比较了四种网页代理接口的有效性和效率,发现RAG、MCP和NLWeb在效果和效率上均优于HTML。

Journal ref Proceedings of the ACM Web Conference 2026 (WWW '26), April 13-17, 2026, Dubai, United Arab Emirates. ACM, New York, NY, USA, pp. 8493-8496

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18976 2026-04-22 cs.CL 70%

STAR-Teaming: A Strategy-Response Multiplex Network Approach to Automated LLM Red Teaming

STAR-Teaming:一种基于策略-响应多plex网络的自动化LLM红队方法

MinJae Jung, YongTaek Lim, Chaeyun Kim, Junghwan Kim, Kihyun Kim, Minwoo Kim

机构 * DATUMO INC(DATUMO公司)

专题命中 工具调用 :agent(abstract);multi-agent(abstract);分类 cs.CL

AI总结 本文提出STAR-Teaming,一种基于多plex网络的自动化红队方法,通过网络驱动优化生成有效攻击策略,提升LLM策略漏洞的可解释性并降低计算成本。

Comments Accepted at ACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19664 2026-04-22 cs.IR 67%

ECLASS-Augmented Semantic Product Search for Electronic Components

基于ECLASS的语义产品搜索增强

Nico Baumgart, Markus Lange-Hegermann, Jan Henze

专题命中 工具调用 :agent(abstract);autonomous agent(abstract)

AI总结 本文提出利用LLM密集检索和ECLASS层次语义提升电子元件语义搜索效果,实验显示其在准确率和效率上均优于传统方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19264 2026-04-22 cs.CV 67%

DR-MMSearchAgent: Deepening Reasoning in Multimodal Search Agents

DR-MMSearchAgent:多模态搜索代理中的深度推理

Shengqin Wang, Wentao Yan, Huichi Zhou, Yihang Chen, Kun Shao, Zhizhong Zhang, Yuan Xie

机构 * Department of XXX, University of YYY, Location, Country(XXX系,YYY大学,地点,国家) School of ZZZ, Institute of WWW, Location, Country(ZZZ学院,WWW研究所,地点,国家) East China Normal University(东华大学) Shanghai Innovation Institute(上海创新研究院) University College London(伦敦大学学院) Independent Researcher(独立研究者) Huawei Noah’s Ark Lab(华为诺亚实验室)

专题命中 工具调用 :agent(abstract);agentic(abstract)

AI总结 本文提出DR-MMSearchAgent框架,通过结构接近性从完整批处理轨迹中提取优势信号,提升不同长度轨迹的生成能力,并采用差异化高斯奖励动态校准交互容忍度,以提高信息可靠性并减少冗余。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19440 2026-04-22 cs.CL cs.NE 57%

What Makes an LLM a Good Optimizer? A Trajectory Analysis of LLM-Guided Evolutionary Search

什么使一个LLM成为好的优化器?LLM引导的进化搜索轨迹分析

Xinhao Zhang, Xi Chen, François Portet, Maxime Peyrard

机构 * Univ. Grenoble Alpes, CNRS, Grenoble INP, LIG(格勒诺布尔阿尔卑斯大学、国家科学研究中心、格勒诺布尔INP、LIG实验室)

专题命中 工具调用 :agentic(abstract);分类 cs.CL

AI总结 研究通过分析15个LLM在8个任务上的优化轨迹,发现初始能力相似的模型会产生差异大的搜索轨迹,强优化器表现为局部细化,弱优化器则出现语义漂移,解决方案新颖性只有在搜索保持局部化时才有效。

Comments 9 pages, 8 figures, Accepted at Findings of ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09172 2026-04-22 math.CO cs.AI cs.CC 57%

Reinforced Generation of Combinatorial Structures: Ramsey Numbers

增强的组合结构生成:Ramsey数

Ansh Nagda, Prabhakar Raghavan, Abhradeep Thakurta

机构 * University of California, Berkeley(加州大学伯克利分校) Google DeepMind(谷歌DeepMind) Google(谷歌)

专题命中 工具调用 :agent(abstract);分类 cs.AI

AI总结 本文通过AlphaEvolve算法改进了九个经典Ramsey数的下界,同时恢复了所有已知精确Ramsey数的下界,并在许多其他情况下匹配了最佳下界。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11793 2026-04-22 cs.CL 57%

MiroThinker: Pushing the Performance Boundaries of Open-Source Research Agents via Model, Context, and Interactive Scaling

MiroThinker:通过模型、上下文和交互扩展推动开源研究代理的性能边界

MiroMind Team, Song Bai, Lidong Bing, Carson Chen, Guanzheng Chen, Yuntao Chen, Zhe Chen, Ziyi Chen, Jifeng Dai, Xuan Dong, Wenhan Dou, Yue Deng, Yunjie Fu, Junqi Ge, Chenxia Han, Tammy Huang, Zhenhang Huang, Jerry Jiao, Shilei Jiang, Tianyu Jiao, Xiaoqi Jian, Lei Lei, Ruilin Li, Gen Luo, Tiantong Li, Xiang Lin, Ziyuan Liu, Zhiqi Li, Jie Ni, Qiang Ren, Pax Sun, Shiqian Su, Chenxin Tao, Bin Wang, Wenhai Wang, Haonan Wang, James Wang, Jin Wang, Jojo Wang, Letian Wang, Shizun Wang, Weizhi Wang, Zixuan Wang, Jinfan Xu, Sen Xing, Chenyu Yang, Hai Ye, Jiaheng Yu, Yue Yu, Muyan Zhong, Tianchen Zhao, Xizhou Zhu, Yanpeng Zhou, Yifan Zhang, Zhi Zhu

机构 * MiroMind Team(MiroMind团队)

专题命中 工具调用 :agent(abstract);分类 cs.CL

AI总结 MiroThinker通过模型、上下文和交互扩展提升开源研究代理性能,实现更深入的交互和更复杂的任务处理,其72B版本在多个基准测试中表现优异,接近商业模型。

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03753 2026-04-22 cs.CR cs.LG 57%

Spatiotemporal-Aware Bit-Flip Injection on DNN-based Advanced Driver Assistance Systems (extended version)

时空感知的位翻转注入在基于深度神经网络的高级驾驶辅助系统中

Taibiao Zhao, Xiang Zhang, Mingxuan Sun, Ruyi Ding, Xugui Zhou

专题命中 工具调用 :planning(abstract);分类 cs.LG

AI总结 本文提出STAFI框架,通过空间和时间感知方法识别DNN中关键故障点,实验表明其发现的危险故障比基线方法多29.56倍。

Comments The authors have identified issues in the experimental setup and evaluation that may affect the validity of the results. In particular, inconsistencies in the fault injection protocol and temporal analysis may lead to incorrect conclusions. The authors therefore request withdrawal for thorough revision

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19509 2026-04-22 cs.RO cs.MA 50%

Assessing VLM-Driven Semantic-Affordance Inference for Non-Humanoid Robot Morphologies

评估基于视觉语言模型的非人形机器人语义可及性推理

Jess Jones, Raul Santos-Rodriguez, Sabine Hauert

机构 * Bristol Robotics Laboratory, University of Bristol(布里斯托尔机器人实验室,布里斯托尔大学) University of Bristol(布里斯托尔大学)

专题命中 工具调用 :tool use(abstract)

AI总结 本文研究了视觉语言模型在非人形机器人上的语义可及性推理能力,通过混合数据集分析发现模型在不同物体和机器人形态上表现不一,存在保守预测倾向,需结合其他方法以提高性能。

Comments AAMAS 2026 (main track), 9 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18407 2026-04-22 physics.pop-ph quant-ph 50%

The Rise of Quantum Computing -- Take a BITE for Built Environment and Urban Microclimate Research

量子计算的兴起——为建筑环境和城市微气候研究提供一份额外的见解

Liangzhu Leon Wang, Huiheng Liu, Honghao Fu, Zhipeng Deng, Bing Dong, Naiping Gao

专题命中 工具调用 :planning(abstract)

AI总结 本文探讨量子计算在建筑环境和城市微气候研究中的应用潜力,提出'BITE'原则指导量子加速问题的选择,旨在提升城市可持续性和能源效率。

Comments 16 pages, 3 figures

Journal ref Build. Simul. (2026) 1-12

详情

展开后加载摘要…

URL PDF HTML 收藏