arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 5047 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 5047 篇

2512.20156 2026-01-21 cs.CL cs.AI cs.SD eess.AS 62%

Fun-Audio-Chat Technical Report

Fun-Audio-Chat 技术报告

Tongyi Fun Team, Qian Chen, Luyao Cheng, Chong Deng, Xiangang Li, Jiaqing Liu, Chao-Hong Tan, Wen Wang, Junhao Xu, Jieping Ye, Qinglin Zhang, Qiquan Zhang, Jingren Zhou

机构 * Alibaba Group(阿里巴巴集团)

专题命中 工具调用 :function calling(abstract);分类 cs.AI、cs.CL

AI总结 Fun-Audio-Chat通过双分辨率语音表示和核心鸡尾酒训练,解决语音-文本模型的时间分辨率不匹配和灾难性遗忘问题,实现高效且高质量的音频理解与生成。

Comments Authors are listed in alphabetical order, 21 pages, open-source at https://github.com/FunAudioLLM/Fun-Audio-Chat

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13075 2026-01-21 cs.LG cs.AI 62%

METIS: Mentoring Engine for Thoughtful Inquiry & Solutions

METIS:面向深入探究与解决方案的导师引擎

Abhinav Rajeev Kumar, Dhruv Trehan, Paras Chopra

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.LG

AI总结 METIS通过工具增强和阶段意识功能,帮助本科生从想法发展到论文,优于GPT-5和Claude Sonnet 4.5,在文档基础阶段表现更佳。

Comments 12 pages, 5 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11560 2026-01-21 cs.IR cs.AI cs.LG 62%

DeepEvidence: Empowering Biomedical Discovery with Deep Knowledge Graph Research

DeepEvidence: 通过深度知识图谱研究赋能生物医学发现

Zifeng Wang, Zheng Chen, Ziwei Yang, Xuan Wang, Qiao Jin, Yifan Peng, Zhiyong Lu, Jimeng Sun

机构 * Keiji AI Institute of Scientific and Industrial Research, Osaka University(大阪大学科学工业研究所) Bioinformatics Center, Institute for Chemical Research, Kyoto University(京都大学化学研究所生物信息中心) Division of Intramural Research, National Library of Medicine, National Institutes of Health(国家卫生研究院生物医学图书馆内部研究部) Department of Population Health Sciences, Weill Cornell Medicine(韦尔·科恩医学中心流行病学与健康科学系) School of Computing and Data Science, University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校计算机与数据科学学院)

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.LG

AI总结 DeepEvidence通过深度知识图谱研究框架,系统化地连接异构生物医学资源,提升科学发现的效率和证据综合能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26854 2026-01-21 cs.AI cs.LG 62%

Inverse Knowledge Search over Verifiable Reasoning: Synthesizing a Scientific Encyclopedia from a Long Chains-of-Thought Knowledge Base

反向知识搜索与可验证推理:从长推理链知识库合成科学百科全书

Yu Li, Yuan Huang, Tao Wang, Caiyu Fan, Xiansheng Cai, Sihan Hu, Xinzijian Liu, Cheng Shi, Mingjun Xu, Zhen Wang, Yan Wang, Xiangqi Jin, Tianhan Zhang, Linfeng Zhang, Lei Wang, Youjin Deng, Pan Zhang, Weijie Sun, Xinyu Li, Weinan E, Linfeng Zhang, Zhiyuan Yao, Kun Chen

机构 * Lanzhou Center for Theoretical Physics, Key Laboratory of Theoretical Physics of Gansu Province, Key Laboratory of Quantum Theory and Applications of MoE, Gansu Provincial Research Center for Basic Disciplines of Quantum Physics(兰州理论物理中心、甘肃省理论物理重点实验室、教育部量子理论与应用重点实验室、甘肃省量子物理基础学科研究省重点中心) Institute of Theoretical Physics, Chinese Academy of Sciences(中国科学院理论物理研究所) DP Technology(DP技术) Institute of Physics, Chinese Academy of Sciences(中国科学院物理研究所) Département d’Informatique, École normale supérieure(巴黎高等师范大学计算机系)

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出了一种基于长推理链知识库的反向知识搜索方法,通过生成可验证的科学百科全书,实现了跨领域科学合成。

Comments 43 pages, 4 figures. This work is part of the SciencePedia project (sciencepedia.bohrium.com). Corrected author name spelling

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07580 2026-01-13 physics.ins-det cs.AI cs.LG hep-ex 62%

Large Language Models for Physics Instrument Design

大型语言模型在物理仪器设计中的应用

Sara Zoccheddu, Shah Rukh Qasim, Patrick Owen, Nicola Serra

专题命中 工具调用 :workflow(abstract);分类 cs.AI、cs.LG

AI总结 本文探讨了大型语言模型在物理仪器设计中的应用,发现其能生成有效且物理合理的配置,尽管未进行特定任务训练,并提出将LLMs与强化学习结合以优化设计工作流。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06604 2026-01-13 cs.AI cs.LG cs.RO 62%

Object-Centric World Models Meet Monte Carlo Tree Search

以对象为中心的世界模型与蒙特卡洛树搜索

Rodion Vakhitov, Leonid Ugadiarov, Aleksandr Panov

机构 * MIPT Moscow(莫斯科米斯托夫物理技术学院) AIRI(人工智能研究所) FRC CSC RAS(俄罗斯科学院计算机科学与应用数学研究所)

专题命中 工具调用 :planning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出ObjectZero算法,通过对象中心表示和图神经网络,结合蒙特卡洛树搜索实现更有效的环境建模与强化学习。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06301 2026-01-13 cs.CR cs.AI cs.SE 62%

Beyond BeautifulSoup: Benchmarking LLM-Powered Web Scraping for Everyday Users

超越BeautifulSoup:为日常用户评估基于LLM的网络爬虫基准测试

Arth Bhardwaj, Nirav Diwan, Gang Wang

专题命中 工具调用 :tool use(abstract);分类 cs.AI、cs.SE

AI总结 本文评估了基于LLM的网络爬虫在日常用户中的应用,展示了端到端LLM代理如何使复杂爬虫变得简单,同时比较了LLM辅助脚本和端到端代理在不同场景下的效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03476 2026-01-08 eess.SY cs.AI cs.LG cs.MA cs.SY 62%

Online Decision-Making Under Uncertainty for Vehicle-to-Building Systems

在不确定环境下为车辆到建筑系统进行在线决策

Rishav Sen, Yunuo Zhang, Fangqi Liu, Jose Paolo Talusan, Ava Pettet, Yoshinori Suzue, Ayan Mukhopadhyay, Abhishek Dubey

机构 * Vanderbilt University(范德比大学) Nissan Advanced Technology Center - Silicon Valley(日产先进技术中心-硅谷)

专题命中 工具调用 :planning(abstract);分类 cs.AI、cs.LG

AI总结 本研究提出了一种基于马尔可夫决策过程的在线决策方法,用于解决车辆到建筑系统在不确定环境下的优化问题,通过在线搜索和启发式剪枝提升效率,实验表明其优于现有方法。

Comments 17 pages, 2 figures, 10 tables. Published in the Proceedings of the 16th ACM/IEEE International Conference on Cyber-Physical Systems (ICCPS '25), May 06--09, 2025, Irvine, CA, USA

Journal ref Proceedings of 16th ACM/IEEE International Conference on Cyber-Physical Systems (ICCPS), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08726 2026-01-08 cs.CL cs.AI 62%

Improved LLM Agents for Financial Document Question Answering

改进的金融文档问答大型语言模型代理

Nelvin Tan, Zian Seng, Liang Zhang, Yu-Ching Shih, Dong Yang, Amol Salunkhe

机构 * American Express(美国美国运通)

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.CL

AI总结 本文提出改进的金融文档问答代理,通过实验展示其在无 oracle 标签情况下的有效性,并引入更安全的计算代理。

Comments 13 pages, 6 figures. More analysis is added to Appendix C

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02714 2026-01-07 cs.AI cs.CL 62%

Time-Scaling Is What Agents Need Now

现在智能体需要时间扩展

Zhi Liu, Guangzhi Wang

机构 * CareerInternational Research Team(CareerInternational研究团队)

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.CL

AI总结 本文提出时间扩展概念,旨在通过扩展时间路径提升智能体的深度推理和问题解决能力,无需增加静态参数。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14244 2026-01-06 cs.CL cs.AI 62%

From Context to EDUs: Faithful and Structured Context Compression via Elementary Discourse Unit Decomposition

从上下文到EDUs:通过基本话语单元分解实现忠实且结构化的上下文压缩

Yiqing Zhou, Yu Lei, Shuzheng Si, Qingyan Sun, Wei Wang, Yifei Wu, Hao Wen, Gang Chen, Fanchao Qi, Maosong Sun

机构 * DeepLang AI Department of Computer Science and Technology, Tsinghua University(计算机科学与技术系,清华大学) Beijing University of Posts and Telecommunications(北京邮电大学) Beijing Jiaotong University(北京交通大学)

专题命中 工具调用 :autonomous agent(abstract);分类 cs.AI、cs.CL

AI总结 本文提出EDU-based Context Compressor,通过基本话语单元分解实现结构化上下文压缩,提升模型在长文档问答和复杂搜索任务中的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19717 2025-12-24 cs.LG cs.AI 62%

Thermodynamic Focusing for Inference-Time Search: Practical Methods for Target-Conditioned Sampling and Prompted Inference

推理时间搜索的热力学聚焦:目标条件采样和提示推理的实用方法

Zhan Zhang

机构 * Zhan Zhang(张湛)

专题命中 工具调用 :planning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出ICFA算法,通过目标条件重新加权提升推理时间搜索效率,结合结构化提示与混合架构实现更高效的样本利用。

Comments 4 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03343 2025-12-15 cs.CL cs.AI 62%

Idea-Gated Transformers: Enforcing Semantic Coherence via Differentiable Vocabulary Pruning

Idea-Gated Transformers: 通过可微分词汇修剪强制语义一致性

Darshan Fofadiya

机构 * Darshan Fofadiya(独立研究者)

专题命中 工具调用 :planning(abstract);分类 cs.AI、cs.CL

AI总结 Idea-Gated Transformers通过可微分词汇修剪机制,实现语义一致性,提升语言模型的领域保留能力与生成可控性。

Comments Code available at https://github.com/DarshanFofadiya/idea-gated-transformers/tree/main

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09909 2025-12-11 cs.LG cs.AI 62%

STACHE: Local Black-Box Explanations for Reinforcement Learning Policies

STACHE:强化学习策略的局部黑盒解释

Andrew Elashkin, Orna Grumberg

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.LG

AI总结 STACHE提出一种用于生成强化学习策略局部黑盒解释的框架,通过鲁棒区域和最小反事实分析,揭示策略行为的演变过程。

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.13871 2025-12-01 cs.LG cs.AI 62%

AlphaViT: A flexible game-playing AI for multiple games and variable board sizes

AlphaViT:一种适用于多种游戏和可变棋盘大小的灵活游戏AI

Kazuhisa Fujita

机构 * Komatsu University(komatsu大学)

专题命中 工具调用 :AI agent(abstract);分类 cs.AI、cs.LG

AI总结 AlphaViT通过融合Vision Transformers开发出灵活的游戏AI,能适应多种游戏和可变棋盘大小,优于传统算法并接近AlphaZero性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07858 2025-11-27 cs.AI cs.LG 62%

Augur: Modeling Covariate Causal Associations in Time Series via Large Language Models

Augur:通过大型语言模型建模时间序列中的协变量因果关联

Zhiqing Cui, Binwu Wang, Qingxiang Liu, Yeqiang Wang, Zhengyang Zhou, Yuxuan Liang, Yang Wang

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.LG

AI总结 Augur通过大型语言模型建模时间序列中的协变量因果关联,提升预测准确性并实现透明的因果推理。

Comments 24 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04231 2025-11-27 cs.LG cs.AI 62%

Empowering Time Series Forecasting with LLM-Agents

用LLM代理增强时间序列预测

Chin-Chia Michael Yeh, Vivian Lai, Uday Singh Saini, Xiran Fan, Yujie Fan, Junpeng Wang, Xin Dai, Yan Zheng

机构 * Visa Research(Visa研究)

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.LG

AI总结 DCATS通过提升数据质量而非模型架构,为时间序列预测的AutoML提供了新的方法,实现了平均6%的误差减少。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13825 2025-11-19 cs.AI cs.CL 62%

When AI Does Science: Evaluating the Autonomous AI Scientist KOSMOS in Radiation Biology

Humza Nusrat, Omar Nusrat

专题命中 工具调用 :agentic(abstract);分类 cs.AI、cs.CL

Comments 13 pages, 3 figures, preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13710 2025-11-18 cs.RO cs.AI cs.LG 62%

From Power to Precision: Learning Fine-grained Dexterity for Multi-fingered Robotic Hands

Jianglong Ye, Lai Wei, Guangqi Jiang, Changwei Jing, Xueyan Zou, Xiaolong Wang

机构 * jianglongye.com/power-to-precision(个人网站)

专题命中 工具调用 :tool use(abstract);分类 cs.AI、cs.LG

Comments Project page: https://jianglongye.com/power-to-precision

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.06261 2025-11-18 cs.LG cs.CL 62%

Hogwild! Inference: Parallel LLM Generation via Concurrent Attention

Gleb Rodionov, Roman Garipov, Alina Shutova, George Yakushev, Erik Schultheis, Vage Egiazarian, Anton Sinitsin, Denis Kuznedelev, Dan Alistarh

机构 * Yandex HSE University(俄罗斯高等经济大学) IST Austria(国际研究所)

专题命中 工具调用 :tool use(abstract);分类 cs.CL、cs.LG

Comments 39th Conference on Neural Information Processing Systems (NeurIPS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12751 2025-11-18 cs.LG cs.AI cs.RO 62%

Are LLMs The Way Forward? A Case Study on LLM-Guided Reinforcement Learning for Decentralized Autonomous Driving

Timur Anvar, Jeffrey Chen, Yuyan Wang, Rohan Chandra

专题命中 工具调用 :planning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.14882 2025-11-14 cs.LG cs.AI 62%

Application-Specific Component-Aware Structured Pruning of Deep Neural Networks in Control via Soft Coefficient Optimization

Ganesh Sundaram, Jonas Ulmen, Amjad Haider, Daniel Görges

机构 * Department of Electrical and Computer Engineering, RPTU University Kaiserslautern-Landau(电气与计算机工程系,RPTU大学卡伊塞拉特兰-兰道)

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.LG

Comments 8 pages, 24th European Control Conference (ECC26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01934 2025-11-11 cs.LG cs.AI 62%

Tool Zero: Training Tool-Augmented LLMs via Pure RL from Scratch

Yirong Zeng, Xiao Ding, Yutai Hou, Yuxian Wang, Li Du, Juyi Dai, Qiuyang Ding, Duyu Tang, Dandan Tu, Weiwen Liu, Bing Qin, Ting Liu

机构 * Harbin Institute of Technology SCIR Lab(哈尔滨工业大学SCIR实验室) Huawei Technologies Co., Ltd(华为技术有限公司) Shanghai Jiao Tong University(上海交通大学) Beijing Academy of Artificial Intelligence(北京人工智能研究院)

专题命中 工具调用 :tool-use(abstract);分类 cs.AI、cs.LG

Comments EMNLP 2025 finding

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.11903 2025-11-11 cs.CL cs.AI 62%

DiLA: Enhancing LLM Tool Learning with Differential Logic Layer

Yu Zhang, Hui-Ling Zhen, Zehua Pei, Yingzhao Lian, Lihao Yin, Mingxuan Yuan, Bei Yu

专题命中 工具调用 :planning(abstract);分类 cs.AI、cs.CL

Comments arXiv admin note: text overlap with arXiv:2305.12295 by other authors

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14846 2025-11-04 cs.AI cs.CL cs.LO 62%

Where to Search: Measure the Prior-Structured Search Space of LLM Agents

Zhuo-Yang Song

机构 * School of Physics, Peking University(物理学院,北京大学)

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.CL

Comments 11 pages, 4 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13579 2025-10-28 cs.RO cs.AI cs.LG 62%

TreeIRL: Safe Urban Driving with Tree Search and Inverse Reinforcement Learning

Momchil S. Tomov, Sang Uk Lee, Hansford Hendrago, Jinwook Huh, Teawon Han, Forbes Howington, Rafael da Silva, Gianmarco Bernasconi, Marc Heim, Samuel Findler, Xiaonan Ji, Alexander Boule, Michael Napoli, Kuo Chen, Jesse Miller, Boaz Floor, Yunqing Hu

机构 * Motional

专题命中 工具调用 :planning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.05894 2025-10-28 cs.LG cs.AI cs.NE 62%

Learning Heuristics for Transit Network Design and Improvement with Deep Reinforcement Learning

Andrew Holliday, Ahmed El-Geneidy, Gregory Dudek

专题命中 工具调用 :planning(abstract);分类 cs.AI、cs.LG

Comments The version of this work presented here is a post-peer-review, pre-copyedit version. The final post-copyedit version that appears in Transportmetrica B is available under open access on the publisher's website: https://www.tandfonline.com/doi/full/10.1080/21680566.2025.2561863

Journal ref Transportmetrica B: Transport Dynamics, 13(1) (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16470 2025-10-21 cs.DB cs.AI cs.SE 62%

Declarative Techniques for NL Queries over Heterogeneous Data

Elham Khabiri, Jeffrey O. Kephart, Fenno F. Heath, Srideepika Jayaraman, Fateh A. Tipu, Yingjie Li, Dhruv Shah, Achille Fokoue, Anu Bhamidipaty

机构 * IBM Research(IBM研究院)

专题命中 工具调用 :agentic(abstract);分类 cs.AI、cs.SE

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12859 2025-10-20 cs.CL cs.AI 62%

PAFT: Prompt-Agnostic Fine-Tuning

Chenxing Wei, Yao Shu, Mingwen Ou, Ying Tiffany He, Fei Richard Yu

机构 * College of Computer Science and Software Engineering, Shenzhen University, China(深圳大学计算机科学与软件工程学院) Tsinghua Shenzhen International Graduate School, Tsinghua University, China(清华大学深圳国际研究生院) Guangdong Lab of AI and Digital Economy (SZ), China(广东人工智能与数字经济实验室(深圳)) Hong Kong University of Science and Technology (Guangzhou), China(香港科技大学(广州)) School of Information Technology, Carleton University, Canada(卡尔顿大学信息科技学院)

专题命中 工具调用 :tool use(abstract);分类 cs.AI、cs.CL

Comments 24 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14106 2025-10-17 cs.AI cs.CL cs.GT 62%

Generating Fair Consensus Statements with Social Choice on Token-Level MDPs

Carter Blair, Kate Larson

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏