arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 5039 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 5039 篇

2602.14234 2026-02-17 cs.AI cs.CL 79%

REDSearcher: A Scalable and Cost-Efficient Framework for Long-Horizon Search Agents

REDSearcher: 一种可扩展且成本效益高的长周期搜索智能体框架

Zheng Chu, Xiao Wang, Jack Hong, Huiming Fan, Yuqi Huang, Yue Yang, Guohai Xu, Chenxiao Zhao, Cheng Xiang, Shengchao Hu, Dongdong Kuang, Ming Liu, Bing Qin, Xing Yu

专题命中 工具调用 :tool use(abstract);planning(abstract);function calling(abstract);分类 cs.AI、cs.CL

AI总结 REDSearcher提出一种统一框架,通过任务合成、中期训练和后期训练优化长周期搜索智能体,实现高效且低成本的搜索任务解决。

Comments https://redsearchagent.github.io/index/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18745 2025-12-23 cs.CV cs.CL cs.LG 79%

InSight-o3: Empowering Multimodal Foundation Models with Generalized Visual Search

InSight-o3: 通过通用视觉搜索增强多模态基础模型

Kaican Li, Lewei Yao, Jiannan Wu, Tiezheng Yu, Jierun Chen, Haoli Bai, Lu Hou, Lanqing Hong, Wei Zhang, Nevin L. Zhang

机构 * Hong Kong University of Science and Technology(香港科技大学) Huawei(华为)

专题命中 工具调用 :agent(abstract);AI agent(abstract);multi-agent(abstract);分类 cs.CL、cs.LG

AI总结 InSight-o3通过通用视觉搜索任务提升多模态基础模型的推理能力,解决复杂视觉信息整合问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24107 2025-09-30 cs.AI cs.LG 79%

Fathom-DeepResearch: Unlocking Long Horizon Information Retrieval and Synthesis for SLMs

Shreyas Singh, Kunal Singh, Pradeep Moturi

机构 * Fractal AI Research(Fractal AI研究)

专题命中 工具调用 :agent(abstract);agentic(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02918 2025-09-22 cs.AI cs.LG 79%

World Modelling Improves Language Model Agents

Shangmin Guo, Omar Darwiche Domingues, Raphaël Avalos, Aaron Courville, Florian Strub

机构 * University of Edinburgh(爱丁堡大学) Cohere Vrije Universiteit Brussel(布鲁塞尔自由大学) Université de Montréal(蒙特利尔大学)

专题命中 工具调用 :tool use(abstract);planning(abstract);function calling(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.10635 2025-07-30 cs.AI cs.CL 79%

Strategist: Self-improvement of LLM Decision Making via Bi-Level Tree Search

Jonathan Light, Min Cai, Weiqin Chen, Guanzhi Wang, Xiusi Chen, Wei Cheng, Yisong Yue, Ziniu Hu

机构 * Rensselaer Polytechnic Institute(拉特加大学) Shenzhen University(深圳大学) University of California, Los Angeles(加州大学洛杉矶分校) NEC laboratories America(NEC美国实验室) California Institute of Technology(加州理工学院)

专题命中 工具调用 :agent(abstract);planning(abstract);multi-agent(abstract);分类 cs.AI、cs.CL

Comments website: https://llm-strategist.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.08148 2025-04-14 cs.AI cs.DB cs.DC cs.LG 79%

Orchestrating Agents and Data for Enterprise: A Blueprint Architecture for Compound AI

Eser Kandogan, Nikita Bhutani, Dan Zhang, Rafael Li Chen, Sairam Gurajada, Estevam Hruschka

专题命中 工具调用 :agent(abstract);planning(abstract);agentic(abstract);分类 cs.AI、cs.LG

Journal ref First Workshop on Data-AI Systems (DAIS), ICDE 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.11808 2023-02-01 cs.LG cs.AI cs.RO math.OC 79%

A Dynamic Programming Algorithm for Finding an Optimal Sequence of Informative Measurements

Peter N. Loxley, Ka-Wai Cheung

专题命中 工具调用 :agent(abstract);autonomous agent(abstract);planning(abstract);分类 cs.AI、cs.LG

Journal ref Entropy, 25, 251 (2023)

详情

展开后加载摘要…

URL PDF HTML 收藏
2011.13729 2021-05-03 cs.AI cs.LG 79%

TStarBot-X: An Open-Sourced and Comprehensive Study for Efficient League Training in StarCraft II Full Game

Lei Han, Jiechao Xiong, Peng Sun, Xinghai Sun, Meng Fang, Qingwei Guo, Qiaobo Chen, Tengfei Shi, Hongsheng Yu, Xipeng Wu, Zhengyou Zhang

专题命中 工具调用 :agent(abstract);AI agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

Comments 29 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2011.12692 2021-01-01 cs.AI cs.LG 79%

Towards Playing Full MOBA Games with Deep Reinforcement Learning

Deheng Ye, Guibin Chen, Wen Zhang, Sheng Chen, Bo Yuan, Bo Liu, Jia Chen, Zhao Liu, Fuhao Qiu, Hongsheng Yu, Yinyuting Yin, Bei Shi, Liang Wang, Tengfei Shi, Qiang Fu, Wei Yang, Lanxiao Huang, Wei Liu

专题命中 工具调用 :agent(abstract);AI agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

Comments NeurIPS 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2005.07677 2020-06-29 cs.AI cs.LG 79%

Finding Game Levels with the Right Difficulty in a Few Trials through Intelligent Trial-and-Error

Miguel González-Duque, Rasmus Berg Palm, David Ha, Sebastian Risi

专题命中 工具调用 :agent(abstract);AI agent(abstract);planning(abstract);分类 cs.AI、cs.LG

Comments To be presented in the Conference on Games 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2003.13741 2020-04-01 cs.LG cs.AI stat.ML 79%

Parallelization of Monte Carlo Tree Search in Continuous Domains

Karl Kurzer, Christoph Hörtnagl, J. Marius Zöllner

专题命中 工具调用 :agent(abstract);planning(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04788 2026-08-06 cs.LG cs.AI cs.CL 新提交 78%

Agentic Reinforcement Learning with Observation-Calibrated Self-Distillation

带有观测校准自蒸馏的智能体强化学习

Yi Yang, Cong Qin, Xiaodan Liu, Chishui Chen, Qing Dong, Yan Zhang, Cao Liu, Zhao Yang, Lu Pan, Jiaye Lin, Yi Feng

机构 * Meituan(美团)

专题命中 工具调用 :agentic(title);分类 cs.AI、cs.CL、cs.LG

AI总结 本研究针对智能体强化学习的混淆问题,提出OCSD方法,通过对比两类回放视图推导观测残差,在高不确定步骤调制GRPO更新,在三类任务和多模型规模上优于基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03741 2026-08-05 cs.DC 新提交 78%

When Does Disaggregation Pay? Simulating Prefill--Decode--Attention--FFN Specialization for Agentic LLM Inference

拆分何时划算?智能体大语言模型推理的预填-解码-注意力-前馈网络专业化模拟

Przemyslaw Forys, Haoran Wu, Can Xiao, Jiayi Nie, Tony Liu, Rika Antonova, Timothy Jones, Robert Mullins, Wayne Luk, Aaron Zhao, George A. Constantinides

专题命中 工具调用 :agentic(title,abstract)

AI总结 该研究提出HeteroPanacea模拟框架,针对智能体LLM推理的预填-解码-注意力-前馈网络拆分,验证其可提升吞吐量,为异构智能体服务系统提供支撑。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00847 2026-08-04 cs.CV 新提交 78%

Models as Tools: An Agentic Coordination Framework for Unified Multimodal Visual Tracking

模型作为工具:用于统一多模态视觉跟踪的智能体协调框架

Wenrui Cai, Yuzhe Li, Qingjie Liu, Yunhong Wang

机构 * Beihang University(北京航空航天大学)

专题命中 工具调用 :agentic(title,abstract)

AI总结 针对现有视觉跟踪方法的瓶颈,提出ACTrack智能体协调框架,整合异构模型工具的互补优势,仅用30%可训练参数便在多类基准上实现性能超越。

Comments 21 pages, 15 Tables, 7 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23672 2026-07-28 cs.LO 新提交 78%

Rethinking Logic Optimization Operators: Theory-Derived Operator Compression via Agentic Source Analysis

重新思考逻辑优化运算符:通过智能源分析实现理论驱动的运算符压缩

Keren Zhu

专题命中 工具调用 :agentic(title,abstract)

AI总结 研究逻辑优化运算符,利用智能源分析制定运算符关系实现理论驱动的运算符压缩,形成TACO,实验表明其在减少运行时、节点数和层级等方面表现出色,TACO - max在特定输入行上有较好的NDP几何平均比率。

Comments 23 pages, 4 figures. Code and data: https://github.com/CODA-Team/TACO

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19801 2026-07-23 cs.IR 新提交 78%

CIR at iKAT SCAI 2026: Exploring Clarification Need Prediction in Agentic Conversational Search

CIR 在 iKAT SCAI 2026 中的研究:探索智能对话搜索中的澄清需求预测

Nolwenn Bernard, Jüri Keller, Philipp Schaer

专题命中 工具调用 :agentic(title,abstract)

AI总结 科隆信息检索小组参与 iKAT SCAI 2026 共享任务,运用配备多种工具的智能对话搜索系统及两种神经澄清需求预测模型进行实验,探索智能对话搜索中的澄清需求预测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19339 2026-07-22 cs.CV 新提交 78%

OmniReasoner: Thinking with Long Audio-Video via Native Tool Use

OmniReasoner:通过原生工具使用进行长音频-视频推理

Yu Chen, Caorui Li, Ziyu Xiong, Yidong Wang, Mingqi Gao, Shuman Liu, Biao Liu, Chunfeng Yang, Anxiang Zeng, Haibo Zhang, Chaofan Chen

专题命中 工具调用 :tool use(title);tool-use(abstract)

AI总结 针对长音频-视频推理难题,OmniReasoner提出工具使用后训练框架,通过监督微调与强化学习让全模态语言模型学会调用放大工具,利用TimeAnchor保持时间参数一致性,借助时间增强数据引擎实现可训练,提升了答案准确性与时间定位能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14893 2026-07-16 cs.RO 版本更新 78%

STITCHER: Constrained Trajectory Planning in Complex Environments with Real-Time Motion Primitive Search

STITCHER:通过实时运动原语搜索在复杂环境中进行约束轨迹规划

Helene J. Levy, Brett T. Lopez

机构 * VECTR Laboratory, University of California, Los Angeles(VECTR实验室,加州大学洛杉矶分校)

专题命中 工具调用 :planning(title,abstract)

AI总结 研究针对自主高速穿越复杂环境的轨迹规划问题,提出无优化规划框架STITCHER,通过拼接短轨迹段和图搜索实时计算轨迹,经模拟与硬件测试验证其性能优越,能满足多种约束并高速实时规划。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12412 2026-07-15 econ.TH 新提交 78%

Choice at Finite Capacity: The Bounded Agent as an Information Channel and the Recovery of Walrasian Demand

有限容量下的选择:作为信息通道的有限理性主体与瓦尔拉斯需求的恢复

Avishek Bhandari

专题命中 工具调用 :agent(title,abstract)

AI总结 研究将购物者建模为有限信息通道,其选择是概率分布。核心方法是分析购物者需求对价格变化的反应模式,主要贡献是揭示其反应模式的对称性及需求受预算和压缩影响,而非理性,还涵盖了有限容量策略的人工主体并给出两商品二次型消费者的封闭形式解。

Comments 27 pages, Keywords: bounded rationality, rational inattention, rate distortion, discrete choice, demand theory, Slutsky equation, information theory

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12575 2026-07-15 cs.CR cs.CY cs.SI 新提交 78%

How Agentic Is Agentic Commerce? A Population-Scale Measurement of x402 Adoption and Authenticity

代理式商业的代理程度如何?x402采用情况与真实性的大规模测量

Shengchen Ling, Yajin Zhou, Lei Wu, Cong Wang

专题命中 工具调用 :agentic(title);AI agent(abstract)

AI总结 研究x402协议在商业中的代理程度,通过链上事件识别结算并确定真正付款人,对Base上的x402进行大规模测量,发现诸多问题,指出结算数量衡量的是可制造性而非采用情况。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10738 2026-07-14 cs.LG cs.AI cs.CL 新提交 78%

To Answer or to Abstain: Mitigating Search-Agent Hallucinations via Abstention-Aware Reinforcement Learning

回答还是弃权:通过弃权感知强化学习减轻搜索代理幻觉

Fengji Zhang, Tianyu Fan, Yuxiang Zheng, Xinyao Niu, Chengen Huang, Jacky Keung, Bei Chen

专题命中 工具调用 :agent(title);分类 cs.AI、cs.CL、cs.LG

AI总结 研究针对大语言模型训练范式易加剧搜索代理幻觉的问题,提出弃权感知强化学习(AWA-RL),利用模型能力动态塑造弃权奖励,并引入RA-F1指标,实验表明该方法有效提升了搜索代理的性能和可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07350 2026-07-09 cs.RO 新提交 78%

Towards Reliable Aerial Ground Vehicle Collaboration: An Integrated Planning and Autonomy Framework for Field Deployment

迈向可靠的空地车辆协作:用于实地部署的集成规划与自主框架

Md Safwan Mondal, Luca Russo, James D. Humann, James M. Dotterweich, Pranav Bhounsule

机构 * University of Illinois Chicago(伊利诺伊大学芝加哥分校) DEVCOM Army Research Laboratory(陆军研究实验室)

专题命中 工具调用 :planning(title,abstract)

AI总结 研究针对无人机长时间任务飞行续航受限问题,提出集成规划与自主框架。通过深度强化学习规划器解决协同路由问题,引入标准化API弥合规划与执行差距,还有轻量级重新规划器,经实验验证系统在动态任务中有强大协同导航和适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14215 2026-07-09 cs.CY 版本更新 78%

Safety Degradation in AI Agents

人工智能代理中的安全退化

Cheng Yu, Benedikt Stroebl, Diyi Yang, Orestis Papakyriakopoulos

专题命中 工具调用 :AI agent(title,abstract)

AI总结 研究人工智能代理安全问题,通过对审查和未审查的语言模型及人工智能代理广泛基准测试,发现随着检索访问扩展,模型出现安全退化现象,基于对齐语言模型构建的支持检索的代理更不安全,强调需缓解策略确保其公平性和可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04259 2026-07-07 cs.RO 新提交 78%

Integrated Graph Search and Model Predictive Control for Smooth and Efficient Path Planning in Autonomous Vehicles

用于自动驾驶车辆平滑高效路径规划的集成图搜索与模型预测控制

Duc-Tien Bui, Ngoc Thinh Nguyen, Hung Duy Nguyen, Dong Bi, Tomislav Mihalj, Arno Eichberger

机构 * Institute of Automotive Engineering, Graz University of Technology(格拉茨工业大学汽车工程研究所) Drone Engineering, University of Applied Science Kufstein Tirol(库夫施泰因蒂罗尔应用科学大学无人机工程系) Automation and Control Institute (ACIN), Vienna University of Technology(维也纳工业大学自动化与控制研究所)

专题命中 工具调用 :planning(title,abstract)

AI总结 提出一种顺序路径规划框架,利用图搜索得到的粗糙路径指导基于模型预测控制的路径细化,在多个超车场景评估算法,相比之前方法能降低横向加速度等,还减少计算成本。

Comments 12th 2026 International Conference on Control, Decision and Information Technologies (CoDIT 2026)

Journal ref 13th 2026 International Conference on Control, Decision and Information Technologies (CoDIT 2026), Bari, Italy, 2026, pp. 1757-1762

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01469 2026-07-07 cs.CV 新提交 78%

A Cost-Aware, Paired Protocol for Auditing Dynamic Tool Synthesis in Agentic Video Question Answering

一种成本感知的配对协议,用于审计智能视频问答中的动态工具合成

Aseel Mohamed, Rama AlHamidi, Mohamed Rayan Barhdadi, Rasul Khanbayov, Erchin Serpedin, Hasan Kurban

机构 * Texas A&M University(德克萨斯农工大学) Hamad Bin Khalifa University(哈马德·本·哈利法大学)

专题命中 工具调用 :agentic(title,abstract)

AI总结 提出成本感知的配对协议,联合评估准确性与成本,揭示动态工具合成在视频问答中的效率与代价。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19425 2026-06-19 hep-ph 新提交 78%

LeWRON: Agentic Analysis of Electroweak Phase Transitions

LeWRON:电弱相变的智能体分析

Isaac R. Wang

专题命中 工具调用 :agentic(title,abstract)

AI总结 提出LeWRON框架,通过智能体编排从拉格朗日量到引力波谱的完整电弱相变分析流程,支持复现和探索模式,并开源代码。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17518 2026-06-17 cs.DC 新提交 78%

SpecGen: Accelerating Agentic Kernel Optimization with Speculative Generation

SpecGen: 利用推测生成加速智能体内核优化

Jihu Guo, Sitian Lu, Tenghui Ma, Wei Gao, Zhisheng Ye, Xingcheng Zhang, Dahua Lin

专题命中 工具调用 :agentic(title,abstract)

AI总结 针对智能体内核优化中生成延迟长、反馈不足和资源利用率低的问题,提出SpecGen系统,通过推测生成在推理过程中提前产生候选内核,并行验证剖析,动态调整资源,并利用远程KV缓存减少前缀重计算,显著降低端到端时间并提升内核加速比。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10438 2026-06-10 econ.TH 新提交 78%

Sequential Search with Planning

带有规划的序贯搜索

Ruhi Sonal, Saptarshi Mukherjee, Abhinaba Lahiri, Aniruddha Ghosh

专题命中 工具调用 :planning(title,abstract)

AI总结 本文通过有序潘多拉盒子模型研究新产品开发或资源勘探中的序贯搜索,引入规划成本,证明存在与已支付范围相关的保留值,并分析保证效应、已支付范围效应和剩余阶段效应对最优策略的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06749 2026-06-08 q-bio.QM 新提交 78%

Deterministic access to global viral sequence data enables robust agentic scientific discovery

确定性访问全球病毒序列数据实现稳健的自主科学发现

Ferdous Nasri, Sarah Gurev, Patrick Varilly, Krithik Ramesh, Nuala A. O'Leary, Jonah Cool, Bernhard Y. Renard, Pardis C. Sabeti, Laura Luebbert

专题命中 工具调用 :agentic(title,abstract)

AI总结 针对基于大语言模型的科学代理在病毒数据检索中的高错误率问题,提出确定性查询框架gget virus,通过形式化NCBI Virus过滤流程、元数据约束和结构化记录检索,将检索准确率提升至90%以上,并减少98%数据传输。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06140 2026-06-05 cs.CR 78%

RedEdit: Agentic Red-Teaming of Image Safety Classifiers via MCTS-Guided Photo-Editing

RedEdit: 基于MCTS引导的照片编辑的图像安全分类器智能红队测试

Weilin Lin, Ziqi Lin, Zhenxing Zhou, Jianze Li, Tong Zhang, Hui Xiong, Li Liu

专题命中 工具调用 :agentic(title);agent(abstract)

AI总结 提出RedEdit,一种基于视觉语言模型提议和蒙特卡洛树搜索规划的黑盒红队代理,通过组合编辑工具序列使不安全图像逃避检测,平均不到两次编辑即可使76.2%的不安全图像绕过分类器,同时保留93.0%的恶意语义。

详情

展开后加载摘要…

URL PDF HTML 收藏