arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 93044 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 5059 篇

2508.03962 2025-08-07 cs.DL cs.AI cs.CL 62%

Accelerating Scientific Discovery with Multi-Document Summarization of Impact-Ranked Papers

Paris Koloveas, Serafeim Chatzopoulos, Dionysis Diamantis, Christos Tryfonopoulos, Thanasis Vergoulis

机构 * University of the Peloponnese(希腊皮洛斯大学)

专题命中 工具调用 :workflow(abstract);分类 cs.AI、cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.10630 2025-07-16 cs.AI cs.SE 62%

Enhancing the Capabilities of Large Language Models for API calls through Knowledge Graphs

Ye Yang, Xue Xiao, Ping Yin, Taotao Xie

专题命中 工具调用 :tool-use(abstract);分类 cs.AI、cs.SE

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.07861 2025-07-11 cs.CV cs.AI cs.LG 62%

Don't Get Me Wrong: How to Apply Deep Visual Interpretations to Time Series

Christoffer Loeffler, Wei-Cheng Lai, Bjoern Eskofier, Dario Zanca, Lukas Schmidt, Christopher Mutschler

机构 * School of Computer Engineering(计算机工程学院) Pontificia Universidad Católica de Valparaíso(瓦尔帕莱索天主教大学) Friedrich-Alexander University Erlangen-Nürnberg(埃尔兰根-纽伦堡弗里德里希-亚历山大大学) Fraunhofer Institute for Integrated Circuits IIS(弗劳恩霍夫集成电路研究所) Hasso-Plattner-Institute(哈索-普拉特纳研究所)

专题命中 工具调用 :tool-use(abstract);分类 cs.AI、cs.LG

Comments 48 pages, 12 figues, 7 tables, 6 algorithms

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05316 2025-07-09 cs.SE cs.AI 62%

OASBuilder: Generating OpenAPI Specifications from Online API Documentation with Large Language Models

Koren Lazar, Matan Vetzler, Kiran Kate, Jason Tsay, David Boaz Himanshu Gupta, Avraham Shinnar, Rohith D Vallam, David Amid Esther Goldbraich, Guy Uziel, Jim Laredo, Ateret Anaby Tavor

机构 * IBM Research(IBM研究院)

专题命中 工具调用 :AI agent(abstract);分类 cs.AI、cs.SE

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.03671 2025-07-08 cs.CL cs.AI 62%

Recon, Answer, Verify: Agents in Search of Truth

Satyam Shukla, Himanshu Dutta, Pushpak Bhattacharyya

机构 * Indian Institute of Technology Bombay(印度理工学院孟买学院)

专题命中 工具调用 :agentic(abstract);分类 cs.AI、cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09655 2025-06-24 cs.AI cs.LG 62%

DipLLM: Fine-Tuning LLM for Strategic Decision-making in Diplomacy

Kaixuan Xu, Jiajun Chai, Sicheng Li, Yuqian Fu, Yuanheng Zhu, Dongbin Zhao

机构 * School of Artificial Intelligence, University of Chinese Academy of Sciences, Beijing, China(人工智能学院,中国科学院大学,北京,中国) State Key Laboratory of Multimodal Artificial Intelligence Systems, Institute of Automation, Chinese Academy of Sciences, Beijing, China(多模态人工智能系统国家重点实验室,自动化研究所,中国科学院,北京,中国)

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.LG

Comments Accepted to the 42nd International Conference on Machine Learning (ICML 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13977 2025-06-18 cs.SE cs.CL 62%

CRITICTOOL: Evaluating Self-Critique Capabilities of Large Language Models in Tool-Calling Error Scenarios

Shiting Huang, Zhen Fang, Zehui Chen, Siyu Yuan, Junjie Ye, Yu Zeng, Lin Chen, Qi Mao, Feng Zhao

机构 * University of Science and Technology of China(中国科学技术大学) Fudan University(复旦大学) Communication University of China(中国传媒大学)

专题命中 工具调用 :tool-use(abstract);分类 cs.CL、cs.SE

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04951 2025-06-16 cs.CR cs.AI cs.LG 62%

Unsafe LLM-Based Search: Quantitative Analysis and Mitigation of Safety Risks in AI Web Search

Zeren Luo, Zifan Peng, Yule Liu, Zhen Sun, Mingchen Li, Jingyi Zheng, Xinlei He

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.07507 2025-06-12 cs.AI cs.LG 62%

Traceable LLM-based validation of statements in knowledge graphs

Daniel Adam, Tomáš Kliegr

专题命中 工具调用 :workflow(abstract);分类 cs.AI、cs.LG

Journal ref Information Processing & Management 62 (2025): 104128

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.05213 2025-06-06 cs.AI cs.CL 62%

LLM-First Search: Self-Guided Exploration of the Solution Space

Nathan Herr, Tim Rocktäschel, Roberta Raileanu

专题命中 工具调用 :planning(abstract);分类 cs.AI、cs.CL

Comments 9 main pages, 2 figures, 2 tables, 36 appendix pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15865 2025-06-03 q-fin.GN cs.AI cs.CL 62%

Standard Benchmarks Fail -- Auditing LLM Agents in Finance Must Prioritize Risk

Zichen Chen, Jiaao Chen, Jianda Chen, Misha Sra

专题命中 工具调用 :workflow(abstract);分类 cs.AI、cs.CL

Comments 46 pages, 2 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20266 2025-05-27 cs.AI cs.LG 62%

syftr: Pareto-Optimal Generative AI

Alexander Conway, Debadeepta Dey, Stefan Hackmann, Matthew Hausknecht, Michael Schmidt, Mark Steadman, Nick Volynets

机构 * DataRobot

专题命中 工具调用 :agentic(abstract);分类 cs.AI、cs.LG

Comments International Conference on Automated Machine Learning (AutoML) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01763 2025-05-27 cs.CL cs.AI cs.IR 62%

Retrieval Models Aren't Tool-Savvy: Benchmarking Tool Retrieval for Large Language Models

Zhengliang Shi, Yuhan Wang, Lingyong Yan, Pengjie Ren, Shuaiqiang Wang, Dawei Yin, Zhaochun Ren

机构 * Shandong University(山东大学) Baidu Inc.(百度公司) Leiden University(莱顿大学)

专题命中 工具调用 :tool-use(abstract);分类 cs.AI、cs.CL

Comments ACL 2025. Code: https://github.com/mangopy/tool-retrieval-benchmark

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15259 2025-05-27 cs.LG cs.CL 62%

ReGUIDE: Data Efficient GUI Grounding via Spatial Reasoning and Search

Hyunseok Lee, Jeonghoon Kim, Beomjun Kim, Jihoon Tack, Chansong Jo, Jaehong Lee, Cheonbok Park, Sookyo In, Jinwoo Shin, Kang Min Yoo

机构 * KAIST(韩国科学技术院) NAVER Cloud(NAVER云)

专题命中 工具调用 :autonomous agent(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15117 2025-05-22 cs.CL cs.AI cs.IR 62%

An Empirical Study on Reinforcement Learning for Reasoning-Search Interleaved LLM Agents

Bowen Jin, Jinsung Yoon, Priyanka Kargupta, Sercan O. Arik, Jiawei Han

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.CL

Comments 22 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14680 2025-05-21 cs.IR cs.AI cs.CL cs.HC 62%

NExT-Search: Rebuilding User Feedback Ecosystem for Generative AI Search

Sunhao Dai, Wenjie Wang, Liang Pang, Jun Xu, See-Kiong Ng, Ji-Rong Wen, Tat-Seng Chua

机构 * Gaoling School of Artificial Intelligence(光明人工智能学院) Renmin University of China(中国人民大学) University of Science and Technology of China(中国科学技术大学) CAS Key Laboratory of AI Safety(中国科学院人工智能安全重点实验室) Institute of Computing Technology(计算技术研究所) Chinese Academy of Sciences(中国科学院) National University of Singapore(新加坡国立大学)

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.CL

Comments SIGIR 2025 Perspective Paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13652 2025-05-21 cs.SE cs.CL 62%

Guided Search Strategies in Non-Serializable Environments with Applications to Software Engineering Agents

Karina Zainullina, Alexander Golubev, Maria Trofimova, Sergei Polezhaev, Ibragim Badertdinov, Daria Litvintseva, Simon Karasik, Filipp Fisin, Sergei Skvortsov, Maksim Nekrashevich, Anton Shevtsov, Boris Yangel

专题命中 工具调用 :agentic(abstract);分类 cs.CL、cs.SE

Comments ICML

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.00054 2025-05-21 cs.CL cs.AI 62%

Automating Intervention Discovery from Scientific Literature: A Progressive Ontology Prompting and Dual-LLM Framework

Yuting Hu, Dancheng Liu, Qingyun Wang, Charles Yu, Chenhui Xu, Qingxiao Zheng, Heng Ji, Jinjun Xiong

机构 * University at Buffalo(布法罗大学) University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.CL

Comments Accepted by IJCAI2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12581 2025-05-20 cs.LG cs.AI cs.CV 62%

An approach based on class activation maps for investigating the effects of data augmentation on neural networks for image classification

Lucas M. Dorneles, Luan Fonseca Garcia, Joel Luís Carbonera

机构 * Department of Computer Science(计算机科学系) Federal University of Rio Grande do Sul(里约格兰德杜斯尔大学)

专题命中 工具调用 :tool use(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.09029 2025-05-15 cs.AI cs.LG 62%

Monte Carlo Beam Search for Actor-Critic Reinforcement Learning in Continuous Control

Hazim Alzorgan, Abolfazl Razi

机构 * School of Computing, Clemson University(计算学院,克莱姆森大学)

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.05059 2025-05-09 cs.AI cs.LG 62%

Enhancing Reinforcement Learning for the Floorplanning of Analog ICs with Beam Search

Sandro Junior Della Rovere, Davide Basso, Luca Bortolussi, Mirjana Videnovic-Misic, Husni Habal

机构 * University of Trieste(特里埃斯特大学) Infineon Technologies AT(英飞凌科技AT) Infineon Technologies AG(英飞凌科技AG)

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.LG

Comments Published in Proceedings of the 21st International Conference on Synthesis, Modeling, Analysis and Simulation Methods, and Applications to Circuit Design (SMACD 2025). 4 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.07944 2025-05-09 cs.SE cs.AI 62%

Enhancing Differential Testing With LLMs For Testing Deep Learning Libraries

Meiziniu Li, Dongze Li, Jianmeng Liu, Jialun Cao, Yongqiang Tian, Shing-Chi Cheung

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) Monash University(墨尔本大学)

专题命中 工具调用 :workflow(abstract);分类 cs.AI、cs.SE

Comments This work has been accepted by ACM TOSEM. Manuscript under final preparation

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.03214 2025-05-07 cs.SE cs.AI 62%

DocSpiral: A Platform for Integrated Assistive Document Annotation through Human-in-the-Spiral

Qiang Sun, Sirui Li, Tingting Bi, Du Huynh, Mark Reynolds, Yuanyi Luo, Wei Liu

机构 * The University of Western Australia(西澳大学) Murdoch University(莫纳什大学) The University of Melbourne(墨尔本大学) Sinograin Chengdu Storage Research Institute Co., Ltd.(中粮成都仓储研究院有限公司)

专题命中 工具调用 :workflow(abstract);分类 cs.AI、cs.SE

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.19738 2025-04-29 cs.AI cs.LG 62%

Learning Efficiency Meets Symmetry Breaking

Yingbin Bai, Sylvie Thiebaux, Felipe Trevizan

专题命中 工具调用 :planning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.08472 2025-04-22 cs.LG cs.AI cs.RO 62%

RILe: Reinforced Imitation Learning

Mert Albaba, Sammy Christen, Thomas Langarek, Christoph Gebhardt, Otmar Hilliges, Michael J. Black

机构 * ETH Zürich(苏黎世联邦理工学院) Max Planck Institute for Intelligent Systems(智能系统马克斯·普朗克研究所)

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.03767 2025-04-14 cs.CR cs.AI cs.LG 62%

MCP Safety Audit: LLMs with the Model Context Protocol Allow Major Security Exploits

Brandon Radosevich, John Halloran

专题命中 工具调用 :agentic(abstract);分类 cs.AI、cs.LG

Comments 27 pages, 21 figures, and 2 Tables. Cleans up the TeX source

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.06683 2025-04-10 cs.LG cs.AI 62%

Hyperparameter Optimisation with Practical Interpretability and Explanation Methods in Probabilistic Curriculum Learning

Llewyn Salt, Marcus Gallagher

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.06271 2025-04-10 cs.IR cs.AI cs.CL 62%

ER-RAG: Enhance RAG with ER-Based Unified Modeling of Heterogeneous Data Sources

Yikuan Xia, Jiazun Chen, Yirui Zhan, Suifeng Zhao, Weipeng Jiang, Chaorui Zhang, Wei Han, Bo Bai, Jun Gao

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.13983 2025-04-09 cs.LG cs.AI 62%

DirectMultiStep: Direct Route Generation for Multistep Retrosynthesis

Yu Shee, Anton Morgunov, Haote Li, Victor S. Batista

专题命中 工具调用 :planning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.12491 2025-04-01 cs.AI cs.LG 62%

AI in radiological imaging of soft-tissue and bone tumours: a systematic review evaluating against CLAIM and FUTURE-AI guidelines

Douwe J. Spaanderman, Matthew Marzetti, Xinyi Wan, Andrew F. Scarsbrook, Philip Robinson, Edwin H. G. Oei, Jacob J. Visser, Robert Hemke, Kirsten van Langevelde, David F. Hanff, Geert J. L. H. van Leenders, Cornelis Verhoef, Dirk J. Gruühagen, Wiro J. Niessen, Stefan Klein, Martijn P. A. Starmans

专题命中 工具调用 :workflow(abstract);分类 cs.AI、cs.LG

Comments 25 pages, 6 figures, 8 supplementary figures

Journal ref eBioMedicine(2025), Volume 114, 105642

详情

展开后加载摘要…

URL PDF HTML 收藏