arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-07-23 至 2026-07-23 共收录 16 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 16 篇

2607.19432 2026-07-23 cs.CR cs.AI 新提交 88%

ChainWatch: A Kill Chain-Aligned Sequential Detection Framework for Multi-Step Attacks in MCP-Based AI Agent Systems

ChainWatch:基于杀伤链的顺序检测框架,用于基于MCP的人工智能代理系统中的多步攻击

Om Narayan, Rashmi Jyoti, Ramkinker Singh

机构 * Computer Science New York University New York, USA(计算机科学 新 York 大学 新 York 美国) Cybersecurity University of Maryland, College Park MD, USA(网络安全 美国马里兰大学College Park分校 MD 美国) Carnegie Mellon University Pittsburgh, USA(卡内基梅隆大学 彭博 美国)

专题命中 工具调用 :agent(title,abstract);AI agent(title,abstract);分类 cs.AI

AI总结 针对基于MCP的人工智能代理系统中现有防御无法可靠检测多步攻击的问题,提出ChainWatch框架,用六阶段杀伤链建模攻击进展,结合隐马尔可夫模型分类工具调用序列,能检测逃避传统机制的攻击链。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16300 2026-07-23 cs.AI 版本更新 88%

Code-in-the-Loop Forensics: Agentic Tool Use for Image Forgery Detection

循环代码取证:面向图像伪造检测的代理工具使用

Fanrui Zhang, Qiang Zhang, Sizhuo Zhou, Jianwen Sun, Chuanhao Li, Jiaxin Ai, Yukang Feng, Yujie Zhang, Wenjie Li, Zizhen Li, Yifan Chang, Jiawei Liu, Kaipeng Zhang

机构 * University of Science and Technology of China(中国科学技术大学) Shanghai Innovation Institute(上海创新研究院) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 工具调用 :tool use(title);agentic(title);agent(abstract);tool-use(abstract)

AI总结 本文提出ForenAgent框架,通过多轮交互使MLLM自主生成并迭代优化Python工具,提升图像伪造检测的灵活性和可解释性,构建FABench数据集进行系统训练和评估。

Comments 18 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19406 2026-07-23 cs.LG 新提交 85%

NMR Elucidation as an Agentic Search Problem, Not a Modeling Problem

核磁共振解析作为一个智能体搜索问题,而非建模问题

Irina Espejo Morales, Damon Hinz, Marvin Alberts, Geraud Krawezik, Haewon Jeong, Shirley Ho

专题命中 工具调用 :agentic(title,abstract);agent(abstract);autonomous agent(abstract);分类 cs.LG

AI总结 研究针对NMR数据结构解析这一化学等领域的瓶颈,构建由冻结语言模型支持的自主智能体,将其解析过程视为受限搜索而非建模任务,在多个数据集上取得良好结果,为自动化光谱分析的多步骤编排框架提供了方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28787 2026-07-23 cs.IR cs.AI 版本更新 85%

Do Data Agents Need Semantic Metadata? A Comparative Study in Agentic Data Retrieval

智能体需要语义元数据吗?智能体数据检索的比较研究

Shiyu Chen, Tarfah Alrashed, Alon Halevy, Natasha Noy

机构 * Google(谷歌)

专题命中 工具调用 :agentic(title,abstract);agent(abstract);autonomous agent(abstract);分类 cs.AI

AI总结 通过对比基线智能体(搜索开放网络)与语义智能体(利用schema.org元数据)在数据检索中的表现,发现语义元数据在检索可操作数据时精度更高(整体精度高65.7%),而基线智能体覆盖更广但存在“最后一英里效用”失败。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19793 2026-07-23 cs.AI cs.CV 新提交 79%

Silent Failures in Multimodal Agentic Search:A Diagnostic Taxonomy and Cross-Judge Evaluation

多模态智能体搜索中的无声故障:一种诊断分类法与跨评判者评估

Zhengxian Wu, Junjie Gao, Kai Yang

机构 * Ant Group(蚂蚁集团)

专题命中 工具调用 :agentic(title,abstract);分类 cs.AI

AI总结 研究多模态智能体搜索中无声故障这一隐藏可靠性问题,引入六类分类法,构建轨迹级诊断管道,通过实验表明表面准确性高估真实正确性,且无声故障与能力相关、常转移。

Journal ref SIGIR 2026 SynthIR Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19801 2026-07-23 cs.IR 新提交 78%

CIR at iKAT SCAI 2026: Exploring Clarification Need Prediction in Agentic Conversational Search

CIR 在 iKAT SCAI 2026 中的研究:探索智能对话搜索中的澄清需求预测

Nolwenn Bernard, Jüri Keller, Philipp Schaer

专题命中 工具调用 :agentic(title,abstract)

AI总结 科隆信息检索小组参与 iKAT SCAI 2026 共享任务,运用配备多种工具的智能对话搜索系统及两种神经澄清需求预测模型进行实验,探索智能对话搜索中的澄清需求预测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19453 2026-07-23 cs.LG cs.AI q-fin.ST q-fin.TR 新提交 62%

Predictive Extrema, Unprofitable Policies: An AI-Assisted Audit of Candle-Based Binance Spot Timing Models

预测极值、无利可图的策略:基于蜡烛图的币安现货时机模型的人工智能辅助审计

Ayoub Jadouli

机构 * Abdelmalek Essaâdi University(阿卜杜勒马莱克·埃萨阿迪大学)

专题命中 工具调用 :AI agent(abstract);分类 cs.AI、cs.LG

AI总结 研究基于蜡烛图的机器学习模型能否将加密货币极值预测转化为币安现货正向策略,通过模型运行和模拟器获取数值结果,经人工监督的AI代理辅助审计,结果显示多数测试协议未确立正向可执行策略价值,操作决策应为不交易。

Comments 23 pages, 5 figures, 8 tables. Simulation-only negative empirical study and human-supervised AI-assisted evidence audit. No live trading or investment advice. Code and available artifacts: https://github.com/AyoubJadouli/Quantbot-Research-Framework

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05901 2026-07-23 cs.CL cs.AI 版本更新 62%

Reducing Hallucinations in Complex Question Answering using Simple Graph-based Retrieval-Augmented Generation (long version)

减少复杂问答中的幻觉:使用基于简单图的检索增强生成(长版)

Christopher J. Wedge, Joshua Stutter, Danny Dixon, Jacek Cała

机构 * National Innovation Centre for Data(数据创新研究中心)

专题命中 工具调用 :agentic(abstract);分类 cs.AI、cs.CL

AI总结 本研究提出一种轻量级图结构支持的检索增强生成系统,通过结合向量搜索和图查询工具,在复杂问答任务中将幻觉答案数量减半,并显著提升事实正确性的精确率和召回率。

Comments 25 pages; expanded limitations section, corrected typos throughout and missing values in appendix table 1

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19739 2026-07-23 cs.IR cs.AI 新提交 57%

Personalized Recommendation Tool Learning via Autonomous Language Agents

通过自主语言智能体进行个性化推荐工具学习

Mingdai Yang, Zhiwei Liu, Weizhi Zhang, Yibo Wang, Hao Peng, Philip Yu

机构 * Microsoft(微软公司)

专题命中 工具调用 :agent(abstract);分类 cs.AI

AI总结 研究针对基于大语言模型的智能体在推荐系统中的局限性,提出PRTA框架,让LLM作中央规划器与多推荐模型交互,负责高级推理和个性化工具选择,传统模型进行全排序评分,设计反射机制,实验表明该框架提升了全排序推荐性能。

Comments 6 pages. Accepted by RecSys'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19518 2026-07-23 cs.AI 新提交 57%

Sophisticated Policies from Epistemic Priors

基于认知先验的复杂策略

Wouter W. L. Nuijten, Bert de Vries

机构 * Eindhoven University of Technology(埃因霍温理工大学) Lazy Dynamics(懒动力学)

专题命中 工具调用 :planning(abstract);分类 cs.AI

AI总结 研究探讨复杂推理在主动推理中的作用,通过在反应迷宫中评估,发现单独要素不足,复杂推理和全联合认知先验主动推理结合认知驱动与闭环推理解决环境问题,优势源于闭环形式,可在认知先验变分推理中表示。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19506 2026-07-23 quant-ph cs.AI 新提交 57%

Hybrid LLM-Guided Search for Quantum Reservoir Architecture Design

用于量子储层架构设计的混合大语言模型引导搜索

Krishna Bhatia, Gautami Sanjay Naik

机构 * QuantumAI Lab, Fractal Analytics India(量子AI实验室,Fractal Analytics印度)

专题命中 工具调用 :agent(abstract);分类 cs.AI

AI总结 研究量子储层计算架构设计问题,提出基于模拟器的基准测试\method,比较五种策略,其中\hybrid策略表现出色,在多任务中优于随机搜索,证明生成模型嵌入混合搜索循环可作高级控制器。

Comments 4 pages, 2 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16900 2026-07-23 cs.AI 版本更新 57%

Environment-free Synthetic Data Generation for API-Calling Agents

用于 API 调用智能体的无环境合成数据生成

Seanie Lee, Sanjoy Chowdhury, Chao Jiang, Cheng-Yu Hsieh, Ting-Yao Hu, Alexander T Toshev, Oncel Tuzel, Raviteja Vemulapalli

专题命中 工具调用 :agent(abstract);分类 cs.AI

AI总结 研究针对训练 API 调用 LLM 智能体数据收集瓶颈问题,提出无环境合成数据生成方法,利用 LLMs 生成任务、响应等,经评判器过滤轨迹,在相关基准上评估,结果表明此方法可有效训练智能体,是实用可扩展方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20175 2026-07-23 cs.CV 新提交 50%

PerceptDrive: Perception Prior World-Action Modeling with Adaptive Expert Routing for End-to-End Autonomous Driving

PerceptDrive:用于端到端自动驾驶的具有自适应专家路由的感知先验世界-动作建模

Yushan Liu, Tianxiong Lv, Bohua Wang, Hangqi Fan, Chenxu Zhao, He Zheng, Xuchang Zhong, Yifan Xie, Congyang Zhao, Zhihao Liao, Leigang Luo, Yang Cai, Xiao-Ping Zhang, Wenbo Ding

机构 * Tsinghua University(清华大学) AMap, Alibaba Group(高德软件有限公司,阿里巴巴集团)

专题命中 工具调用 :planning(abstract)

AI总结 研究针对自动驾驶中感知基础模型的问题,提出PerceptDrive框架,将教师提炼先验和观察潜变量输入可训练模型,经特定分支处理、先验保留及场景条件路由,实验表明其性能领先,证实相关方法的有效性及对先验的依赖。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19545 2026-07-23 cs.CR 新提交 50%

When HTTP 402 Meets the Blockchain: Risks on Emerging x402 Payments

当HTTP 402遇上区块链:新兴x402支付的风险

Qinying Wang, Yong Yang, Yuan Chen, Shouling Ji, Mathias Payer

专题命中 工具调用 :AI agent(abstract)

AI总结 研究x402支付协议,通过系统研究确定促进者的安全规则,基于规则违规分析得出新攻击向量,提出半自动黑盒工具评估安全性,发现部署均有违规,还通过实证测量量化相关指标,揭示其安全风险。

Journal ref USENIX Security 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.00711 2026-07-23 math.OC 版本更新 50%

A Line-search-free Method for Adaptive Decentralized Optimization

无线搜索方法用于自适应分布式优化

Xiaokai Chen, Ilya Kuruzov, Gesualdo Scutari

专题命中 工具调用 :agent(abstract)

AI总结 本文提出一种无需线搜索的分布式优化方法,通过自适应调整步长实现高效收敛,适用于凸和强凸目标函数,实验显示优于现有方法。

Comments 8 pages, 6 figures, to appear at the 60th Asilomar Conference on Signals, Systems, and Computers (Asilomar 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.10472 2026-07-23 cond-mat.stat-mech math.PR 50%

Evaluating Gaussianity of heterogeneous fractional Brownian motion

评估异质分数布朗运动的高斯性

Michał Balcerek, Adrian Pacheco-Pozo, Agnieszka Wyłomańska, Diego Krapf

专题命中 工具调用 :tool use(abstract)

AI总结 本文研究了切换分数布朗运动的非高斯行为,通过峰度和Hellinger距离分析其高斯性,探讨异质异常扩散过程的检测方法。

Comments 23 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏