arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 5039 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 5039 篇

2505.14146 2025-11-06 cs.AI cs.CL 76%

s3: You Don't Need That Much Data to Train a Search Agent via RL

Pengcheng Jiang, Xueqiang Xu, Jiacheng Lin, Jinfeng Xiao, Zifeng Wang, Jimeng Sun, Jiawei Han

机构 * University of Illinois Urbana Champaign(伊利诺伊大学厄巴纳-香槟分校) Amazon(亚马逊公司)

专题命中 工具调用 :agent(title);分类 cs.AI、cs.CL

Comments EMNLP 2025 camera-ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.04535 2025-09-23 cs.CL cs.AI 76%

Meta-Reasoning Improves Tool Use in Large Language Models

Lisa Alazraki, Marek Rei

机构 * Imperial College London(伦敦帝国学院)

专题命中 工具调用 :tool use(title);分类 cs.AI、cs.CL

Comments NAACL 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.21071 2025-06-27 cs.LG cs.CL 76%

Enhancing LLM Tool Use with High-quality Instruction Data from Knowledge Graph

Jingwei Wang, Zai Zhang, Hao Qian, Chunjing Gan, Binbin Hu, Ziqi Liu, Zhiqiang Zhang, Jun Zhou, Bin Shi, Bo Dong

机构 * Ant Group, China(蚂蚁集团) School of Computer Science and Technology, Xi’an Jiaotong University, China(西安交通大学计算机科学与技术学院) School of Distance Education, Xi’an Jiaotong University, China(西安交通大学继续教育学院)

专题命中 工具调用 :tool use(title);分类 cs.CL、cs.LG

Comments 20 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01940 2025-06-12 cs.CL cs.AI 76%

AskToAct: Enhancing LLMs Tool Use via Self-Correcting Clarification

Xuan Zhang, Yongliang Shen, Zhe Zheng, Linjuan Wu, Wenqi Zhang, Yuchen Yan, Qiuying Peng, Jun Wang, Weiming Lu

机构 * Zhejiang University(浙江大学) OPPO Research Institute(OPPO研究院)

专题命中 工具调用 :tool use(title);分类 cs.AI、cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.14562 2025-04-30 cs.CL cs.AI cs.HC cs.MA 76%

Agentic AI: The Era of Semantic Decoding

Maxime Peyrard, Martin Josifoski, Robert West

机构 * Univ. Grenoble Alpes, CNRS, Grenoble INP, LIG EPFL(格勒诺布尔阿尔卑斯大学、国家科学研究中心、格勒诺布尔INP、LIG EPFL)

专题命中 工具调用 :agentic(title);分类 cs.AI、cs.CL

Comments 25 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.05255 2025-04-25 cs.SE cs.CL 76%

CallNavi, A Challenge and Empirical Study on LLM Function Calling and Routing

Yewei Song, Xunzhu Tang, Cedric Lothritz, Saad Ezzini, Jacques Klein, Tegawendé F. Bissyandé, Andrey Boytsov, Ulrick Ble, Anne Goujon

机构 * University of Luxembourg(卢森堡大学) Luxembourg Institute of Science and Technology(卢森堡科学与技术研究所) Department of Information and Computer Science(信息与计算机科学系) BGL BNP PARIBAS Interdisciplinary Research Center for Intelligent Manufacturing and Robotics(智能制造与机器人跨学科研究中心)

专题命中 工具调用 :function calling(title);分类 cs.CL、cs.SE

Journal ref The 29th International Conference on Evaluation and Assessment in Software Engineering (EASE 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12094 2025-02-18 cs.AI cs.CL 76%

A Study on Leveraging Search and Self-Feedback for Agent Reasoning

Karthikeyan K, Michelle Yuan, Elman Mansimov, Katerina Margatina, Anurag Pratik, Daniele Bonadiman, Monica Sunkara, Yi Zhang, Yassine Benajiba

专题命中 工具调用 :agent(title);分类 cs.AI、cs.CL

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.08129 2023-11-03 cs.CV cs.AI cs.CL 76%

AVIS: Autonomous Visual Information Seeking with Large Language Model Agent

Ziniu Hu, Ahmet Iscen, Chen Sun, Kai-Wei Chang, Yizhou Sun, David A Ross, Cordelia Schmid, Alireza Fathi

专题命中 工具调用 :agent(title);分类 cs.AI、cs.CL

Comments Published on NeurIPS 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.11301 2023-10-24 cs.LG cs.AI cs.RO 76%

Adversarial Search and Tracking with Multiagent Reinforcement Learning in Sparsely Observable Environment

Zixuan Wu, Sean Ye, Manisha Natarajan, Letian Chen, Rohan Paleja, Matthew C. Gombolay

专题命中 工具调用 :agent(abstract,comments);multi-agent(abstract,comments);分类 cs.AI、cs.LG

Comments Accepted by IEEE International Symposium on Multi-Robot & Multi-Agent Systems (MRS) 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.13484 2023-06-26 cs.AI cs.LG 76%

Adaptive Planning Search Algorithm for Analog Circuit Verification

Cristian Manolache, Cristina Andronache, Alexandru Caranica, Horia Cucu, Andi Buzo, Cristian Diaconu, Georg Pelz

专题命中 工具调用 :planning(title);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.05742 2022-12-13 cs.LG cs.AI cs.MA cs.SY eess.SY 76%

Where to go: Agent Guidance with Deep Reinforcement Learning in A City-Scale Online Ride-Hailing Service

Jiyao Li, Vicki H. Allan

专题命中 工具调用 :agent(title);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2207.00475 2022-07-04 cs.CV cs.AI cs.LG eess.IV 76%

Agent with Tangent-based Formulation and Anatomical Perception for Standard Plane Localization in 3D Ultrasound

Yuxin Zou, Haoran Dou, Yuhao Huang, Xin Yang, Jikuan Qian, Chaojiong Zhen, Xiaodan Ji, Nishant Ravikumar, Guoqiang Chen, Weijun Huang, Alejandro F. Frangi, Dong Ni

专题命中 工具调用 :agent(title);分类 cs.AI、cs.LG

Comments Accepted by MICCAI 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2010.03599 2021-11-04 cs.LG cs.AI 76%

Improved POMDP Tree Search Planning with Prioritized Action Branching

John Mern, Anil Yildiz, Larry Bush, Tapan Mukerji, Mykel J. Kochenderfer

专题命中 工具调用 :planning(title);分类 cs.AI、cs.LG

Comments 7 pages

Journal ref AAAI-21 Technical Tracks Vol. 35, No. 13, 2021, 11888-11894

详情

展开后加载摘要…

URL PDF HTML 收藏
2005.11335 2020-05-26 cs.LG cs.AI 76%

Single-Agent Optimization Through Policy Iteration Using Monte-Carlo Tree Search

Arta Seify, Michael Buro

专题命中 工具调用 :agent(title);分类 cs.AI、cs.LG

Comments Poster presentation at RL in Games Workshop, AAAI 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
1810.11954 2018-11-22 cs.CL cs.AI 76%

A Knowledge-Grounded Multimodal Search-Based Conversational Agent

Shubham Agarwal, Ondrej Dusek, Ioannis Konstas, Verena Rieser

专题命中 工具调用 :agent(title);分类 cs.AI、cs.CL

Journal ref Proceedings of the 2018 EMNLP Workshop SCAI: The 2nd International Workshop on Search-Oriented Conversational AI, pages 59-66, Brussels, Belgium, October 2018

详情

展开后加载摘要…

URL PDF HTML 收藏
1702.00020 2017-02-02 cs.AI cs.LG physics.chem-ph 76%

Towards "AlphaChem": Chemical Synthesis Planning with Tree Search and Deep Neural Network Policies

Marwin Segler, Mike Preuß, Mark P. Waller

专题命中 工具调用 :planning(title);分类 cs.AI、cs.LG

Comments 4 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13653 2026-07-28 cs.CV cs.RO 版本更新 75%

Exploratory, Communicative, and Deployable: Vision-Driven Embodied Agents for Open-World Mobile Manipulation

探索性、交流性和可部署性:用于开放世界移动操作的视觉驱动具身智能体

Boyu Mi, Mengchen Ma, Yifei Yao, Xing Gao, Junting Chen, Yangzi Li, Zihou Zhu, Guohao Li, Zhenfei Yin, Tai Wang, Yao Mu, Jiangmiao Pang, Hanqing Wang

专题命中 工具调用 :agent(abstract);tool-use(abstract);agentic(abstract)

AI总结 研究针对具身智能体现实部署难题,提出REAL框架,通过建立一致环境API、设计任务组合优化性能,引入REAL - Bench评估。实验显示其智能体在交互式任务中表现出色,在物理机器人上也实现高成功率,弥合现实差距。

Comments Accepted to ECCV 2026. 57 pages. Code available at https://github.com/InternRobotics/REAL

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21361 2026-07-24 cs.MA 新提交 75%

FedAgentKE: Federated Semantic Knowledge Evolution for Heterogeneous Agents

FedAgentKE:异构智能体的联邦语义知识演化

Weihao Li, Jun Bai, Ziyang Song

专题命中 工具调用 :agent(abstract);tool use(abstract);workflow(abstract)

AI总结 研究异构智能体孤立运行问题,提出 FedAgentKE 框架,通过语义知识蒸馏、聚合和Adapt实现联邦语义知识演化,实验验证其在跨框架和跨任务设置下能改进智能体协作,为未来协作智能体生态系统发展提供潜力。

Comments 9 pages (including appendix)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14108 2026-07-17 cs.CL cs.AI cs.SE 新提交 75%

Eta Given Delta: Defining LLM Tool Efficiency With Marginal Tool Utility

给定增量的埃塔:用边际工具效用定义大语言模型工具效率

Nyx Iskandar

机构 * Foam(泡沫)

专题命中 工具调用 :agent(abstract);tool use(abstract);分类 cs.AI、cs.CL、cs.SE

AI总结 研究提出用于评估LLM智能体轨迹中工具调用率的工具效率及边际工具效用指标,用LLM-as-a-Judge确定边际工具效用符号,区别于间接测效率的 prior work,直接测效率,为LLM评估研究及相关工程做贡献。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08010 2026-07-10 cs.CL cs.LG cs.SE 新提交 75%

Tool-Making and Self-Evolving LLM Agents in Low-Latency Systems

低延迟系统中的工具制作与自我进化大语言模型智能体

Kalle Kujanpää, Ning Liu, Shahnawaz Alam, Yeshwanth Reddy Sura, Tianyu Yang, Kristina Klinkner, Shervin Malmasi

机构 * Amazon(亚马逊)

专题命中 工具调用 :agent(abstract);agentic(abstract);分类 cs.CL、cs.LG、cs.SE

AI总结 研究如何解决生产LLM智能体因重复生成代码浪费延迟和可靠性的问题,提出用智能工具制作管道取代推理时编码循环,部署该方法使系统更快、更可靠、易操作,降低延迟和错误率,提高可审计性。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02345 2026-07-03 cs.SE cs.AI cs.CL 新提交 75%

SkillFuzz: Fuzzing Skill Composition for Implicit Intents Discovery in Open Skill Marketplaces

SkillFuzz: 面向开放技能市场中隐式意图发现的技能组合模糊测试

Jinwei Hu, Yi Dong, Youcheng Sun, Xiaowei Huang

机构 * School of Computer Science and Informatics, University of Liverpool(利物浦大学计算机科学与信息学学院) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

专题命中 工具调用 :agent(abstract);planning(abstract);分类 cs.AI、cs.CL、cs.SE

AI总结 提出SkillFuzz,首个无需执行的模糊测试方法,通过提取结构化技能契约并利用契约引导的蒙特卡洛树搜索,在开放技能市场中高效发现因技能组合导致的隐式意图,验证了80%以上高风险组合。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01972 2026-07-03 cs.CL cs.AI cs.LG 新提交 75%

Object Aligner: A Configurable JSON Schema Similarity Score for Graphs, Applied to LLM Prompt Optimization

Object Aligner: 一种可配置的图结构JSON模式相似度评分,应用于LLM提示优化

Jan Drchal

机构 * Artificial Intelligence Center, Faculty of Electrical Engineering, Czech Technical University in Prague(捷克理工大学电气工程学院人工智能中心)

专题命中 工具调用 :planning(abstract);agentic(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 提出Object Aligner,一种基于递归树对齐和引用对齐的JSON相似度评分方法,通过Weisfeiler-Leman颜色细化近似图同构,用于LLM输出评估和提示优化。

Comments 28 pages, This is a submitted version of a manuscript under review at IEEE Access; it has not been peer reviewed

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20755 2026-06-12 eess.AS 版本更新 75%

DuplexSLA: A Full-Duplex Spoken Language Model with Synchronized Speech, Language, and Action

DuplexSLA: 一种具备同步语音、语言和动作的全双工语音语言模型

Haoyang Zhang, Jun Chen, Donghang Wu, Yuxin Li, Yuxin Zhang, Xiangyu Tony Zhang, Che Liu, Qingjian Lin, Yizhou Peng, Hexin Liu, Eng Siong Chng, Chao Yan, Boyong Wu, Yechang Huang, Xuerui Yang, Fei Tian

专题命中 工具调用 :tool use(abstract);planning(abstract);agentic(abstract)

AI总结 本研究提出DuplexSLA,一种全双工语音语言模型,通过共享160ms时间线解码助理音频和结构化动作流,实现了同步语音、语言和动作的处理,解决了现有全双工模型在对话中规划和工具调用方面的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.00225 2026-06-08 cs.LG cs.AI cs.CL 版本更新 75%

Should You Use Your Large Language Model to Explore or Exploit?

你应该使用你的大语言模型进行探索还是利用?

Keegan Harris, Aleksandrs Slivkins

机构 * UC Berkeley(伯克利大学) Microsoft Research(微软研究院)

专题命中 工具调用 :agent(abstract);tool use(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 研究当前大语言模型在探索-利用权衡中的决策能力,通过分离探索和利用任务评估其表现,发现推理模型在利用任务上最有潜力但成本高,非推理模型通过工具使用和上下文总结可提升中等难度任务性能,但在所有任务中均不如简单线性回归,然而LLM在具有语义的大动作空间探索中有帮助。

Comments Accepted to UAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00945 2026-04-02 cs.CY 75%

A Visionary Look at Vibe Researching

对Vibe研究的前瞻性展望

Yebo Feng, Yang Liu

专题命中 工具调用 :agent(abstract);tool use(abstract);multi-agent(abstract)

AI总结 本文探讨了Vibe研究范式,结合人类指导与AI代理,提出多智能体架构、记忆、工具使用等方法,分析其技术限制与社会影响,为负责任的采用提供路线图。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23079 2026-03-25 cs.RO 75%

AirSimAG: A High-Fidelity Simulation Platform for Air-Ground Collaborative Robotics

AirSimAG:一种高保真空地协同机器人仿真平台

Yangjie Cui, Xin Dong, Boyang Gao, Jinwu Xiang, Daochun Li, Zhan Tu

机构 * School of Aeronautic Science and Engineering, Beihang University(北京航空航天大学航空科学与工程学院) Hangzhou International Innovation Institute, Beihang University(北京航空航天大学杭州国际创新研究院) Institution of Unmanned System, Beihang University(北京航空航天大学无人系统研究院)

专题命中 工具调用 :agent(abstract);planning(abstract);multi-agent(abstract)

AI总结 本文提出AirSimAG,一种高保真的空地协同机器人仿真平台,支持多智能体同步仿真和异构传感控制接口,通过多个代表性任务验证其在多智能体协调和跨模态数据一致性方面的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16964 2026-02-20 cs.IR 75%

SAGE: Structure Aware Graph Expansion for Retrieval of Heterogeneous Data

SAGE:面向异构数据检索的结构感知图扩展

Prasham Titiya, Rohit Khoja, Tomer Wolfson, Vivek Gupta, Dan Roth

专题命中 工具调用 :agent(abstract);planning(abstract);agentic(abstract)

AI总结 SAGE通过构建结构感知的图扩展框架,在异构数据检索中提升召回率,采用混合检索与代理策略实现多模态证据链检索。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11858 2026-02-17 cs.CV cs.AI cs.CL cs.LG 75%

Zooming without Zooming: Region-to-Image Distillation for Fine-Grained Multimodal Perception

无需缩放:用于细粒度多模态感知的区域到图像蒸馏

Lai Wei, Liangbo He, Jun Lan, Lingzhong Dong, Yutong Cai, Siyuan Li, Huijia Zhu, Weiqiang Wang, Linghe Kong, Yue Wang, Zhuosheng Zhang, Weiran Huang

机构 * School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学学院) Zhongguancun Academy(中关村学院) Shanghai Innovation Institute(上海创新研究院)

专题命中 工具调用 :tool use(abstract);agentic(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文提出区域到图像蒸馏方法,通过训练时间内化代理缩放能力,提升细粒度多模态感知性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18207 2026-01-27 cs.LG cs.AI cs.CL cs.IR 75%

PaperSearchQA: Learning to Search and Reason over Scientific Papers with RLVR

PaperSearchQA: 基于强化学习与验证奖励的学习科学论文搜索与推理

James Burgess, Jan N. Hansen, Duo Peng, Yuhui Zhang, Alejandro Lozano, Min Woo Sun, Emma Lundberg, Serena Yeung-Levy

机构 * Stanford University(斯坦福大学) Chan Zuckerberg Biohub Network(查纳·泽克拜尔生物枢纽网络) KTH Royal Institute of Technology(皇家理工学院)

专题命中 工具调用 :agent(abstract);planning(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 PaperSearchQA通过训练搜索代理在科学论文中进行搜索与推理,提升技术问答能力,为未来的人工智能科学家系统奠定基础。

Comments EACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11540 2026-01-21 cs.HC 75%

Exploring General-Purpose Autonomous Multimodal Agents for Pathology Report Generation

探索通用型自主多模态代理用于病理报告生成

Marc Aubreville, Taryn A. Donovan, Christof A. Bertram

专题命中 工具调用 :agent(abstract);tool use(abstract);agentic(abstract)

AI总结 研究探索通用型自主多模态代理在病理报告生成中的应用,发现其在无额外信息时诊断准确率较低,但提供形态学描述时表现更佳,但仍不及人类专家。

Comments 6 pages, 1 figure, accepted paper for BVM 2026

Journal ref BVM 2026, https://bvm-conf.org

详情

展开后加载摘要…

URL PDF HTML 收藏