arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-03-12 至 2026-03-12 共收录 11 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 11 篇

2511.05271 2026-03-12 cs.CV cs.AI 86%

DeepEyesV2: Toward Agentic Multimodal Model

DeepEyesV2:迈向代理多模态模型

Jack Hong, Chenxiao Zhao, ChengLin Zhu, Weiheng Lu, Guohai Xu, Xing Yu

专题命中 工具调用 :agentic(title,abstract);tool use(abstract);tool-use(abstract);分类 cs.AI

AI总结 DeepEyesV2通过两阶段训练方法实现代理多模态模型,结合数据构建、训练优化和评估,提升现实世界推理与工具调用能力。

Comments Accepted to ICLR2026. Homepage: https://visual-agent.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10069 2026-03-12 cs.LG cs.CL 81%

Improving Search Agent with One Line of Code

通过一行代码改进搜索代理

Jian Li, Dongsheng Chen, Zhenhua Xu, Yizhang Jin, Jiafu Wu, Chengjie Wang, Xiaotong Yuan, Yabiao Wang

机构 * Nanjing University(南京大学) Tencent YoutuLab(腾讯优图实验室)

专题命中 工具调用 :agent(title);agentic(abstract);分类 cs.CL、cs.LG

AI总结 通过一行代码改进搜索代理,提出SAPO算法以稳定训练并提升性能

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10213 2026-03-12 cs.CL 77%

Sabiá-4 Technical Report

Sabiá-4 技术报告

Thiago Laitz, Thales Sales Almeida, Hugo Abonizio, Roseval Malaquias Junior, Giovana Kerche Bonás, Marcos Piau, Celio Larcher, Ramon Pires, Rodrigo Nogueira

机构 * Maritaca AI Jusbrasil

专题命中 工具调用 :tool use(abstract);function calling(abstract);agentic(abstract);分类 cs.CL

AI总结 Sabiá-4和Sabiazinho-4是新一代巴西葡萄牙语模型,通过四阶段训练流程提升法律文档、多轮对话和智能体任务能力,实现成本与性能的平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09375 2026-03-12 cs.LG 74%

Latent Poincaré Shaping for Agentic Reinforcement Learning

隐式庞加莱形变用于代理强化学习

Hanchen Xia, Baoyou Chen, Zelin Zang, Yutang Ge, Guojiang Zhao, Siyu Zhu

专题命中 工具调用 :agentic(title);分类 cs.LG

AI总结 LaPha通过在庞加莱潜在空间中引入隐式形变,提升LLM代理在数学任务中的性能,实现自我引导的测试时间扩展和更高的准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10285 2026-03-12 cs.HC cs.AI cs.CY cs.DL cs.ET 70%

Conversational AI-Enhanced Exploration System to Query Large-Scale Digitised Collections of Natural History Museums

对话式AI增强的探索系统用于查询自然历史博物馆大规模数字化收藏

Yiyuan Wang, Andrew Johnston, Zoë Sadokierski, Rhiannon Stephens, Shane T. Ahyong

机构 * School of Computer Science, University of Technology Sydney(技术科技大学计算机科学学院) School of Design, University of Technology Sydney(技术科技大学设计学院) Australian Museum Research Institute, Australian Museum(澳大利亚博物馆研究 institute, 澳大利亚博物馆) Australian Museum(澳大利亚博物馆)

专题命中 工具调用 :agent(abstract);AI agent(abstract);分类 cs.AI

AI总结 本文提出利用对话式AI查询自然历史博物馆大规模数字化收藏的系统,通过交互式地图和自然语言代理实现高效的数据检索与探索。

Comments 25 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10955 2026-03-12 cs.CR cs.AI 70%

Beyond Max Tokens: Stealthy Resource Amplification via Tool Calling Chains in LLM Agents

超越最大令牌:通过工具调用链实现隐秘的资源放大

Kaiyu Zhou, Yongsen Zheng, Yicheng He, Meng Xue, Xueluan Gong, Yuji Wang, Xuanye Zhang, Kwok-Yan Lam

机构 * Nanyang Technological University, Singapore(南洋理工大学,新加坡) University of Illinois Urbana-Champaign, United States(伊利诺伊大学厄巴纳-香槟分校,美国) The Hong Kong University of Science and Technology, Hong Kong(香港科学与技术大学,香港) Shanghai Jiao Tong University, China(上海交通大学,中国)

专题命中 工具调用 :agent(abstract);agentic(abstract);分类 cs.AI

AI总结 本文提出了一种基于工具调用链的隐秘DoS攻击,通过多轮交互显著提升LLM的资源消耗,挑战现有安全防护机制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.09723 2026-03-12 cs.HC cs.CL 70%

AgentA/B: Automated and Scalable Web A/BTesting with Interactive LLM Agents

AgentA/B: 基于交互式LLM代理的自动化和可扩展的网页A/B测试

Yuxuan Lu, Ting-Yao Hsu, Hansu Gu, Limeng Cui, Yaochen Xie, William Headden, Bingsheng Yao, Akash Veeragouni, Jiapeng Liu, Sreyashi Nag, Jessie Wang, Dakuo Wang

机构 * Northeastern University(东北大学) Pennsylvania State University(宾夕法尼亚州立大学) Amazon USA(亚马逊美国)

专题命中 工具调用 :agent(abstract);autonomous agent(abstract);分类 cs.CL

AI总结 AgentA/B通过交互式LLM代理实现自动化和可扩展的网页A/B测试,模拟用户行为以评估网页设计效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10163 2026-03-12 cs.CR cs.AI 57%

Compatibility at a Cost: Systematic Discovery and Exploitation of MCP Clause-Compliance Vulnerabilities

兼容性代价:系统性发现和利用MCP条款合规性漏洞

Nanzi Yang, Weiheng Bai, Kangjie Lu

专题命中 工具调用 :AI agent(abstract);分类 cs.AI

AI总结 本文提出首个系统性框架,用于分析MCP条款合规性漏洞,通过构建中间表示、静态分析和攻击模式引导管道,发现并利用兼容性滥用攻击。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10042 2026-03-12 cs.CR cs.AI 57%

Targeted Bit-Flip Attacks on LLM-Based Agents

针对基于大语言模型(LLM)的智能体的位翻转攻击

Jialai Wang, Ya Wen, Zhongmou Liu, Yuxiao Wu, Bingyi He, Zongpeng Li, Ee-Chien Chang

专题命中 工具调用 :agent(abstract);分类 cs.AI

AI总结 本文提出Flip-Agent,首个针对基于LLM的智能体的位翻转攻击框架,通过操控最终输出和工具调用,揭示LLM智能体系统中的关键安全漏洞。

Comments To appear in DAC 2026 (Design Automation Conference)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01630 2026-03-12 cs.AI stat.AP 57%

SEED-SET: Scalable Evolving Experimental Design for System-level Ethical Testing

SEED-SET: 可扩展的演进实验设计用于系统层面的伦理测试

Anjali Parashar, Yingke Li, Eric Yang Yu, Fei Chen, James Neidhoefer, Devesh Upadhyay, Chuchu Fan

专题命中 工具调用 :autonomous agent(abstract);分类 cs.AI

AI总结 SEED-SET通过结合客观评估和主观价值判断,提供了一种高效的伦理测试方法,生成更优的测试候选者并提高高维搜索空间的覆盖范围。

Comments 10 main pages along with Appendix containing additional results, manuscript accepted in ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04393 2026-03-12 q-bio.GN q-bio.QM 50%

pHapCompass: Probabilistic Assembly and Uncertainty Quantification of Polyploid Haplotype Phase

pHapCompass: 多倍体等位基因相的概率组装与不确定性量化

Marjan Hosseini, Ella Veiner, Thomas Bergendahl, Tala Yasenpoor, Zane Smith, Margaret Staton, Derek Aguiar

专题命中 工具调用 :workflow(abstract)

AI总结 pHapCompass是一种用于多倍体基因组等位基因组装的概率算法,通过建模读取分配的不确定性,提供对等位基因相位的分布估计,并通过图论算法实现统计推断和不确定性量化。

详情

展开后加载摘要…

URL PDF HTML 收藏