arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 5039 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 5039 篇

2606.10875 2026-06-10 cs.CL 新提交 77%

Pushing the Limits of LLM Tool Calling via Experiential Knowledge Integration and Activation

通过经验知识集成与激活推动LLM工具调用极限

Yupu Hao, Zhuoran Jin, Huanxuan Liao, Kang Liu, Jun Zhao

机构 * The Key Laboratory of Cognition and Decision Intelligence for Complex Systems, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所复杂系统认知与决策智能重点实验室) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)

专题命中 工具调用 :autonomous agent(abstract);tool use(abstract);tool-use(abstract);分类 cs.CL

AI总结 研究如何通过经验知识获取、激活和内化提升LLM多步工具调用性能,提出知识增强工具执行框架KATE,结合宽度扩展推理与知识感知训练,在BFCL-V3和AppWorld上显著优于基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07867 2026-06-09 cs.CL 新提交 77%

The Cold-Start Safety Gap in LLM Agents

LLM智能体中的冷启动安全差距

Chung-En Sun, Linbo Liu, Tsui-Wei Weng

机构 * University of California, San Diego(加州大学圣地亚哥分校)

专题命中 工具调用 :agent(abstract,abstract_cn);agentic(abstract);分类 cs.CL

AI总结 研究发现工具调用型LLM智能体在会话开始时最脆弱,随着常规任务执行安全性提升,提出SODA基准并验证预热策略可缩小冷启动安全差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02963 2026-06-03 cs.LG 77%

KForge: LLM-Driven Cross-Platform Kernel Generation for AI Accelerators

KForge:面向AI加速器的LLM驱动跨平台内核生成

Taras Sereda, Burak Bartan, Ankita Nayak, Tom St. John, Natalie Serrino, Zain Asgar

机构 * Gimlet Labs Inc(Gimlet实验室)

专题命中 工具调用 :agent(abstract);agentic(abstract);multi-agent(abstract);分类 cs.LG

AI总结 提出KForge框架,通过两个协作的LLM代理(生成代理和性能分析代理)迭代优化,自动生成跨平台高性能内核,在NVIDIA B200和Intel Arc B580上分别实现2.12%的吞吐量提升和5.13倍的几何平均加速。

Comments Accepted at ISCA 2026 Workshop MLArchSys

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31268 2026-06-01 cs.CL 77%

Mellum2 Technical Report

Mellum2 技术报告

Marko Kojic, Ivan Bondyrev, Aral de Moor, Joseph Shtok, Petr Borovlev, Kseniia Lysaniuk, Madeeswaran Kannan, Ivan Dolgov, Nikita Pavlichenko

机构 * JetBrains Constructor University(Constructor大学)

专题命中 工具调用 :tool use(abstract);function calling(abstract);agentic(abstract);分类 cs.CL

AI总结 本文介绍 Mellum 2,一个12B参数(每token激活2.5B)的混合专家语言模型,专攻软件工程,通过架构创新和训练优化在代码生成、数学推理等基准上达到4B-14B开源模型的竞争力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30838 2026-06-01 cs.AI 77%

COMPASS: Cognitive MCTS-Guided Process Alignment for Safe Search Agents

COMPASS: 认知MCTS引导的过程对齐用于安全搜索代理

Wenkai Shen, Pengyang Zhou, Jiahe Xu, Jiaming Qian, Haozhe He, Zhihao Huang, Chaochao Chen, Xiaolin Zheng

机构 * Zhejiang University(浙江大学)

专题命中 工具调用 :agent(abstract);tool use(abstract);workflow(abstract);分类 cs.AI

AI总结 提出COMPASS框架,通过认知树探索和自省步骤对齐,在保持通用效用的同时实现搜索代理工作流中的鲁棒安全对齐。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26691 2026-05-27 cs.AI 77%

Mind the Tool Failures: Achieving Synergistic Tool Gains for Medical Agents

注意工具故障:实现医疗智能体的协同工具增益

Yunhui Gan, Tan Pan, Kaiyu Guo, Limei Han, Weimiao Yu, Guangnan Ye, Chen Jiang, Yuan Cheng

机构 * Fudan University(复旦大学) Shanghai Academy of Artificial Intelligence for Science(上海人工智能科学研究院) Shanghai Innovation Institute(上海创新研究院) The University of Queensland(昆士兰大学) Bioinformatics Institute (BII), Agency for Science, Technology and Research (A*STAR)(生物信息研究所(BII),科技研究局(A*STAR))

专题命中 工具调用 :AI agent(abstract);tool use(abstract);agentic(abstract);分类 cs.AI

AI总结 针对医疗AI智能体在真实临床环境中工具可能失败的问题,提出基于GRPO的强化学习框架,通过实例级工具选择和分歧感知协同学习,实现错误工具共识的纠正,提升系统鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17774 2026-05-27 cs.CL 77%

Internalizing Tool Knowledge in Small Language Models via QLoRA Fine-Tuning

通过QLoRA微调将工具知识内化到小型语言模型中

Yuval Shemla, Ayal Yakobe, Tanmay Agarwal, Dhaval Patel, Kaoutar El Maghraoui

机构 * Columbia School of General Studies, Columbia University, NY, USA(哥伦比亚大学泛研学院) Columbia Engineering, Columbia University, NY, USA(哥伦比亚大学工程学院) IBM Research, NY, USA(IBM研究院)

专题命中 工具调用 :tool-use(abstract);planning(abstract);agentic(abstract);分类 cs.CL

AI总结 本文研究通过QLoRA参数高效微调将工具知识内化到小型语言模型中,在AssetOpsBench基准上,微调后的Gemma 4 E4B和Qwen3-4B模型在无描述推理下优于有完整工具描述的未微调基线,输入长度减少82.6%,规划分数提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13360 2026-05-15 cs.LG 77%

Speculative Interaction Agents: Building Real-Time Agents with Asynchronous I/O and Speculative Tool Calling

推测交互代理:构建具有异步I/O和推测性工具调用的实时代理

Coleman Hooper, Minwoo Kang, Suhong Moon, Nicholas Lee, Eric Wen, John Wawrzynek, Michael W. Mahoney, Yakun Sophia Shao, Amir Gholami, Kurt Keutzer

机构 * University of California, Berkeley(加州大学伯克利分校) ICSI LBNL(劳伦斯伯克利国家实验室)

专题命中 工具调用 :agent(abstract);workflow(abstract);agentic(abstract);分类 cs.LG

AI总结 本文提出推测交互代理,通过异步I/O和推测性工具调用,实现复杂多轮工具调用的实时交互,提升实时应用性能。

Comments 17 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04712 2026-05-12 cs.CV cs.AI eess.IV 77%

SAR-RAG: ATR Visual Question Answering by Semantic Search, Retrieval, and MLLM Generation

SAR-RAG:通过语义搜索、检索和MLLM生成实现目标识别的视觉问答

David F. Ramirez, Tim Overman, Kristen Jaskie, Joe Marvin, Andreas Spanias

机构 * SenSIP Center, School of ECEE, Arizona State University(SenSIP中心,电子与计算机工程学院,亚利桑那州立大学) Prime Solutions Group Inc(Prime Solutions Group公司)

专题命中 工具调用 :agent(abstract);AI agent(abstract);agentic(abstract);分类 cs.AI

AI总结 本文提出SAR-RAG方法,结合多模态大语言模型和语义嵌入向量数据库,通过语义搜索和检索提升SAR图像目标识别的准确性,通过分类和回归指标验证效果。

Comments Accepted to 2026 SPIE Defense + Security, Automatic Target Recognition XXXVI

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08904 2026-05-12 cs.AI 77%

OPT-BENCH: Evaluating the Iterative Self-Optimization of LLM Agents in Large-Scale Search Spaces

OPT-BENCH:评估大搜索空间中LLM代理的迭代自我优化

Xiaozhe Li, Jixuan Chen, Xinyu Fang, Shengyuan Ding, Haodong Duan, Qingwen Liu, Kai Chen

机构 * Tongji University(同济大学) Shanghai AI Lab(上海人工智能实验室) Fudan University(复旦大学) Zhejiang University(浙江大学) University of California San Diego(加州大学圣地亚哥分校)

专题命中 工具调用 :agent(abstract,abstract_cn);tool use(abstract);分类 cs.AI

AI总结 OPT-BENCH通过结合20个机器学习任务和10个经典NP难问题,评估LLM代理在大规模搜索空间中通过内在自我反思而非机械工具应用进行适应的能力,揭示更强模型在反馈利用上的优势及基础能力的限制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03294 2026-04-27 cs.CR cs.AI 77%

AgentMark: Utility-Preserving Behavioral Watermarking for Agents

AgentMark:用于代理的效用保持行为水印

Kaibo Huang, Jin Tan, Yukun Wei, Wanling Li, Zipei Zhang, Hui Tian, Zhongliang Yang, Linna Zhou

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Huaqiao University(华侨大学)

专题命中 工具调用 :agent(abstract);tool-use(abstract);planning(abstract);分类 cs.AI

AI总结 本文提出AgentMark,一种用于代理的行为水印方法,通过在规划决策中嵌入多比特标识符以保持效用,适用于黑盒API和动作层内容水印。

Comments Accepted to ACL 2026 (Main, Poster)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06879 2026-04-14 cs.IR cs.AI 77%

WisPaper: Your AI Scholar Search Engine

WisPaper:你的AI学者搜索引擎

Li Ju, Jun Zhao, Mingxu Chai, Ziyu Shen, Xiangyang Wang, Yage Geng, Chunchun Ma, Hao Peng, Guangbin Li, Tao Li, Chengyong Liao, Fu Wang, Xiaolong Wang, Junshen Chen, Rui Gong, Shijia Liang, Feiyan Li, Ming Zhang, Kexin Tan, Junjie Ye, Zhiheng Xi, Shihan Dou, Tao Gui, Yuankai Ying, Yang Shi, Yue Zhang, Qi Zhang

机构 * Fudan University(复旦大学)

专题命中 工具调用 :agent(abstract);workflow(abstract);agentic(abstract);分类 cs.AI

AI总结 本文提出WisPaper,一种端到端代理系统,通过整合模块解决学术文献搜索中的语义限制和工作流程碎片化问题,提升文献发现、组织和跟踪效率。

Comments 18 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02155 2026-04-03 cs.CL 77%

Brief Is Better: Non-Monotonic Chain-of-Thought Budget Effects in Function-Calling Language Agents

简洁即更好:函数调用语言代理中的非单调链式思维预算效应

Xuan Qi

机构 * IIIS, Tsinghua University(清华大学交叉信息研究院)

专题命中 工具调用 :agent(abstract);tool-use(abstract);function calling(abstract);分类 cs.CL

AI总结 研究探讨了链式思维预算对函数调用代理性能的影响,发现简短的链式思维显著提升准确性,而延长的链式思维反而降低性能,提出Function-Routing CoT方法提升可靠性。

Comments 21 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10213 2026-03-12 cs.CL 77%

Sabiá-4 Technical Report

Sabiá-4 技术报告

Thiago Laitz, Thales Sales Almeida, Hugo Abonizio, Roseval Malaquias Junior, Giovana Kerche Bonás, Marcos Piau, Celio Larcher, Ramon Pires, Rodrigo Nogueira

机构 * Maritaca AI Jusbrasil

专题命中 工具调用 :tool use(abstract);function calling(abstract);agentic(abstract);分类 cs.CL

AI总结 Sabiá-4和Sabiazinho-4是新一代巴西葡萄牙语模型,通过四阶段训练流程提升法律文档、多轮对话和智能体任务能力,实现成本与性能的平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08181 2026-03-10 cs.LG 77%

AutoAdapt: An Automated Domain Adaptation Framework for LLMs

AutoAdapt:一种用于大语言模型的自动化领域适应框架

Sidharth Sinha, Anson Bastos, Xuchao Zhang, Akshay Nambi, Chetan Bansal, Saravan Rajmohan

专题命中 工具调用 :agent(abstract);planning(abstract);multi-agent(abstract);分类 cs.LG

AI总结 AutoAdapt通过多代理辩论系统和AutoRefine方法,实现高效可靠的LLM领域适应,提升领域适应性能25%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22450 2026-02-27 cs.CR cs.AI 77%

Silent Egress: When Implicit Prompt Injection Makes LLM Agents Leak Without a Trace

静默逃逸:当隐式提示注入使LLM代理无痕泄露

Qianlong Lan, Anuj Kaul, Shaun Jones, Stephanie Westrum

机构 * eBay

专题命中 工具调用 :agent(abstract);workflow(abstract);agentic(abstract);分类 cs.AI

AI总结 研究揭示了代理式LLM系统中隐式提示注入导致的静默逃逸风险,通过实验展示恶意网页诱导代理泄露敏感信息的机制,并提出分片逃逸策略及网络层防御改进方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21320 2026-02-26 cs.LG 77%

Tool-R0: Self-Evolving LLM Agents for Tool-Learning from Zero Data

Tool-R0:从零数据自我进化的大语言模型代理用于工具学习

Emre Can Acikgoz, Cheng Qian, Jonas Hübotter, Heng Ji, Dilek Hakkani-Tür, Gokhan Tur

机构 * UIUC(伊利诺伊大学香槟分校) ETH Zurich(苏黎世联邦理工学院)

专题命中 工具调用 :autonomous agent(abstract);tool-use(abstract);agentic(abstract);分类 cs.LG

AI总结 Tool-R0通过自我对抗强化学习从零数据训练通用工具调用代理,实现92.5%的性能提升并超越完全监督基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14281 2026-02-25 cs.CR cs.CL 77%

MCPShield: A Security Cognition Layer for Adaptive Trust Calibration in Model Context Protocol Agents

MCPShield: 一种用于模型上下文协议代理自适应信任校准的安全认知层

Zhenhong Zhou, Yuanhe Zhang, Hongwei Cai, Moayad Aloqaily, Ouns Bouachir, Linsey Pang, Prakhar Mehrotra, Kun Wang, Qingsong Wen

专题命中 工具调用 :agent(abstract);tool use(abstract);agentic(abstract);分类 cs.CL

AI总结 MCPShield通过元数据引导探测和历史轨迹推理,提升代理在调用MCP工具时的安全性,有效防御MCP攻击。

Comments 21 pages, 5 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18914 2026-02-24 cs.SE 77%

From Docs to Descriptions: Smell-Aware Evaluation of MCP Server Descriptions

从文档到描述:面向MCP服务器描述的气味aware评估

Peiran Wang, Ying Li, Yuqiang Sun, Chengwei Liu, Yang Liu, Yuan Tian

专题命中 工具调用 :agent(abstract);tool-use(abstract);agentic(abstract);分类 cs.SE

AI总结 本文提出了一种针对MCP服务器描述气味的系统研究,揭示了描述质量对LLM工具选择的影响,并展示了气味引导修复的实用价值。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16725 2026-02-03 cs.AI 77%

LongCat-Flash-Thinking-2601 Technical Report

LongCat-Flash-Thinking-2601 技术报告

Meituan LongCat Team, Anchun Gui, Bei Li, Bingyang Tao, Bole Zhou, Borun Chen, Chao Zhang, Chao Zhang, Chen Gao, Chen Zhang, Chengcheng Han, Chenhui Yang, Chuyu Zhang, Cong Chen, Cunguang Wang, Daoru Pan, Defei Bu, Dengchang Zhao, Di Xiu, Dishan Liu, Dongyu Ru, Dunwei Tu, Fan Wu, Fengcheng Yuan, Fengcun Li, Gang Xu, Guanyu Wu, Guoyuan Lin, Haibin Wang, Hansi Yang, Hao Yang, Haonan Yan, Haoxiang Ma, Haoxing Wen, Hongyan Hao, Hongyin Tang, Hongyu Zang, Hongzhi Ni, Hui Su, Jiacheng Zhang, Jiahong Zhou, Jiahuan Li, Jiaming Wang, Jian Yang, Jianfei Zhang, Jianhao Xu, Jianing Wang, Jiapeng Zhu, Jiaqi Sun, Jiarong Shi, Jiarui Zhao, Jingang Wang, Jinluan Yang, Jinrui Ding, Jinwei Xiao, Jiyuan He, Juncan Xu, Kefeng Zhang, Keheng Wang, Li Wei, Lianhui Ma, Lin Qiu, Lingbing Kong, Lingchuan Liu, Linsen Guo, Mengshen Zhu, Mengxia Shen, Mingyang Zhu, Peiguang Li, Peng Pei, Peng Zhao, Pengcheng Jia, Pengtao Zhang, Ping Liu, Qi Gu, Qiong Huang, Qiyuan Duan, Quanchi Weng, Rongxiang Weng, Rongzhi Zhang, Rumei Li, Shanglin Lei, Shengnan An, Shijun Dai, Shizhe Wu, Shuaikang Liu, Shuang Zhou, Shuo Wang, Songyuan Zhao, Tao Liang, Tianhao Hu, Tianze Chen, Wei Liu, Wei Shi, Wei Wang, Weifeng Tang, Wenjie Shi, Wenlong Zhu, Wentao Chen, Wentao Shi, Xi Su, Xiandi Ma, Xiangcheng Liu, Xiangyu Xi, Xiangyuan Liu, Xiangzhou Huang, Xiao Liu, Xiaodong Cai, Xiaolong Chen, Xiaowei Shi, Xiaoyu Li, Xin Chen, Xingchen Liu, Xuan Huang, Xuezhi Cao, Xunliang Cai, Yan Chen, Yang Bai, Yang Liu, Yang Yang, Yang Zheng, Yanyu Chen, Yaoming Wang, Yaoming Zhu, Yaorui Shi, Yaqi Huo, Yerui Sun, Yi Zhang, Yi-Kai Zhang, Yifan Lu, Yifan Zhao, Yihao Chen, Yitao Zhai, Yongjing Yin, Yongwei Zhou, Youshao Xiao, Yu Wang, Yu Yang, Yuchen Xie, Yuchen Yu, Yuchuan Dai, Yue Xu, Yueqing Sun, Yufei Zhang, Yuhuai Wei, Yulei Qian, Yunfan Liang, Yunke Zhao, Yuwei Jiang, Yuxin Bian, Yuxin Chen, Yuxin Liu, Zeyang Yu, Zhao Yang, Zhengsheng Huang, Zhengyu Chen, Zhijian Liu, Zhikang Xia, Zhimin Lin, Zhiyuan Yao, Zhuofan Chen, Zhuowen Han, Zijian Zhang, Ziran Li, Ziwen Wang, Ziyuan Zhuang

机构 * Meituan LongCat Team(美团LongCat团队)

专题命中 工具调用 :tool use(abstract);tool-use(abstract);agentic(abstract);分类 cs.AI

AI总结 LongCat-Flash-Thinking-2601是一款拥有5600亿参数的开源混合专家推理模型,通过统一训练框架和Heavy Thinking模式,在代理推理任务中表现出卓越的性能和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12698 2026-01-26 cs.CL 77%

A Two-Stage GPU Kernel Tuner Combining Semantic Refactoring and Search-Based Optimization

一种结合语义重构和基于搜索的优化的双阶段GPU内核调优器

Qiuyi Qu, Yicheng Sui, Yufei Sun, Rui Chen, Xiaofei Zhang, Yuzhi Zhang, Haofeng Wang, Ge Lan

机构 * NanKai University(南开大学) Beijing Institute of Computer Technology and Applications(北京计算机技术与应用研究所)

专题命中 工具调用 :agent(abstract);planning(abstract);agentic(abstract);分类 cs.CL

AI总结 本文提出一种结合语义重构和基于搜索的双阶段GPU内核调优器,通过模板化和参数优化提升内核性能,实现更稳定和高质量的加速效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03137 2026-01-07 cs.DB cs.CL 77%

Accurate Table Question Answering with Accessible LLMs

利用可及的大规模语言模型实现准确的表格问答

Yangfan Jiang, Fei Wei, Ergute Bao, Yaliang Li, Bolin Ding, Yin Yang, Xiaokui Xiao

机构 * National University of Singapore(新加坡国立大学) Alibaba Group(阿里巴巴集团) Mohamed bin Zayed University of Artificial Intelligence(莫卧儿 bin 赞德人工智能大学) Hamad Bin Khalifa University(哈马德 bin 哈利法大学)

专题命中 工具调用 :agent(abstract);workflow(abstract);multi-agent(abstract);分类 cs.CL

AI总结 本文提出Orchestra多智能体方法,利用小型开源LLMs高效解决表格问答问题,实现高质量且低成本的TQA性能。

Comments accepted for publication in the Proceedings of the IEEE International Conference on Data Engineering (ICDE) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09410 2025-12-11 cs.RO cs.LG cs.MA 77%

Generalizable Collaborative Search-and-Capture in Cluttered Environments via Path-Guided MAPPO and Directional Frontier Allocation

在 cluttered 环境中通过路径引导的 MAPPO 和方向性前沿分配实现可泛化的协作搜索与捕获

Jialin Ying, Zhihao Li, Zicheng Dong, Guohua Wu, Yihuan Liao

机构 * Department of Automation, Central South University, Changsha, China(自动化系,中南大学,长沙,中国)

专题命中 工具调用 :agent(abstract);planning(abstract);multi-agent(abstract);分类 cs.LG

AI总结 本文提出 PGF-MAPPO 方法,通过路径引导的 MAPPO 和方向性前沿分配,在 cluttered 环境中实现高效的协作搜索与捕获,展示了出色的泛化能力和性能优势。

Comments 7 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08139 2025-12-10 cs.LG 77%

Robust Agents in Open-Ended Worlds

开放世界中的鲁棒智能体

Mikayel Samvelyan

专题命中 工具调用 :agent(abstract);AI agent(abstract);multi-agent(abstract);分类 cs.LG

AI总结 本研究提出Maestro和MiniHack框架,通过对抗课程和程序化内容生成提升智能体在开放环境中的鲁棒性和泛化能力。

Comments PhD Thesis

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09245 2025-12-04 cs.AI 77%

Jupiter: Enhancing LLM Data Analysis Capabilities via Notebook and Inference-Time Value-Guided Search

木星:通过笔记本和推理时的价值引导搜索增强大语言模型的数据分析能力

Shuocheng Li, Yihao Liu, Silin Du, Wenxuan Zeng, Zhe Xu, Mengyu Zhou, Yeye He, Haoyu Dong, Shi Han, Dongmei Zhang

机构 * Microsoft(微软)

专题命中 工具调用 :agent(abstract);tool use(abstract);tool-use(abstract);分类 cs.AI

AI总结 Jupiter通过将数据分析建模为搜索问题,并结合价值模型和节点访问次数,提升大语言模型在多步推理和工具使用方面的性能。

Comments Accepted to AAAI 2026 (Main Technical Track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02556 2025-12-03 cs.CL 77%

DeepSeek-V3.2: Pushing the Frontier of Open Large Language Models

DeepSeek-V3.2: 推动开放大规模语言模型的前沿

DeepSeek-AI, Aixin Liu, Aoxue Mei, Bangcai Lin, Bing Xue, Bingxuan Wang, Bingzheng Xu, Bochao Wu, Bowei Zhang, Chaofan Lin, Chen Dong, Chengda Lu, Chenggang Zhao, Chengqi Deng, Chenhao Xu, Chong Ruan, Damai Dai, Daya Guo, Dejian Yang, Deli Chen, Erhang Li, Fangqi Zhou, Fangyun Lin, Fucong Dai, Guangbo Hao, Guanting Chen, Guowei Li, H. Zhang, Hanwei Xu, Hao Li, Haofen Liang, Haoran Wei, Haowei Zhang, Haowen Luo, Haozhe Ji, Honghui Ding, Hongxuan Tang, Huanqi Cao, Huazuo Gao, Hui Qu, Hui Zeng, Jialiang Huang, Jiashi Li, Jiaxin Xu, Jiewen Hu, Jingchang Chen, Jingting Xiang, Jingyang Yuan, Jingyuan Cheng, Jinhua Zhu, Jun Ran, Junguang Jiang, Junjie Qiu, Junlong Li, Junxiao Song, Kai Dong, Kaige Gao, Kang Guan, Kexin Huang, Kexing Zhou, Kezhao Huang, Kuai Yu, Lean Wang, Lecong Zhang, Lei Wang, Liang Zhao, Liangsheng Yin, Lihua Guo, Lingxiao Luo, Linwang Ma, Litong Wang, Liyue Zhang, M. S. Di, M. Y Xu, Mingchuan Zhang, Minghua Zhang, Minghui Tang, Mingxu Zhou, Panpan Huang, Peixin Cong, Peiyi Wang, Qiancheng Wang, Qihao Zhu, Qingyang Li, Qinyu Chen, Qiushi Du, Ruiling Xu, Ruiqi Ge, Ruisong Zhang, Ruizhe Pan, Runji Wang, Runqiu Yin, Runxin Xu, Ruomeng Shen, Ruoyu Zhang, S. H. Liu, Shanghao Lu, Shangyan Zhou, Shanhuang Chen, Shaofei Cai, Shaoyuan Chen, Shengding Hu, Shengyu Liu, Shiqiang Hu, Shirong Ma, Shiyu Wang, Shuiping Yu, Shunfeng Zhou, Shuting Pan, Songyang Zhou, Tao Ni, Tao Yun, Tian Pei, Tian Ye, Tianyuan Yue, Wangding Zeng, Wen Liu, Wenfeng Liang, Wenjie Pang, Wenjing Luo, Wenjun Gao, Wentao Zhang, Xi Gao, Xiangwen Wang, Xiao Bi, Xiaodong Liu, Xiaohan Wang, Xiaokang Chen, Xiaokang Zhang, Xiaotao Nie, Xin Cheng, Xin Liu, Xin Xie, Xingchao Liu, Xingkai Yu, Xingyou Li, Xinyu Yang, Xinyuan Li, Xu Chen, Xuecheng Su, Xuehai Pan, Xuheng Lin, Xuwei Fu, Y. Q. Wang, Yang Zhang, Yanhong Xu, Yanru Ma, Yao Li, Yao Li, Yao Zhao, Yaofeng Sun, Yaohui Wang, Yi Qian, Yi Yu, Yichao Zhang, Yifan Ding, Yifan Shi, Yiliang Xiong, Ying He, Ying Zhou, Yinmin Zhong, Yishi Piao, Yisong Wang, Yixiao Chen, Yixuan Tan, Yixuan Wei, Yiyang Ma, Yiyuan Liu, Yonglun Yang, Yongqiang Guo, Yongtong Wu, Yu Wu, Yuan Cheng, Yuan Ou, Yuanfan Xu, Yuduan Wang, Yue Gong, Yuhan Wu, Yuheng Zou, Yukun Li, Yunfan Xiong, Yuxiang Luo, Yuxiang You, Yuxuan Liu, Yuyang Zhou, Z. F. Wu, Z. Z. Ren, Zehua Zhao, Zehui Ren, Zhangli Sha, Zhe Fu, Zhean Xu, Zhenda Xie, Zhengyan Zhang, Zhewen Hao, Zhibin Gou, Zhicheng Ma, Zhigang Yan, Zhihong Shao, Zhixian Huang, Zhiyu Wu, Zhuoshu Li, Zhuping Zhang, Zian Xu, Zihao Wang, Zihui Gu, Zijia Zhu, Zilin Li, Zipeng Zhang, Ziwei Xie, Ziyi Gao, Zizheng Pan, Zongqing Yao, Bei Feng, Hui Li, J. L. Cai, Jiaqi Ni, Lei Xu, Meng Li, Ning Tian, R. J. Chen, R. L. Jin, S. S. Li, Shuang Zhou, Tianyu Sun, X. Q. Li, Xiangyue Jin, Xiaojin Shen, Xiaosha Chen, Xinnan Song, Xinyi Zhou, Y. X. Zhu, Yanping Huang, Yaohui Li, Yi Zheng, Yuchen Zhu, Yunxian Ma, Zhen Huang, Zhipeng Xu, Zhongyu Zhang, Dongjie Ji, Jian Liang, Jianzhong Guo, Jin Chen, Leyi Xia, Miaojun Wang, Mingming Li, Peng Zhang, Ruyi Chen, Shangmian Sun, Shaoqing Wu, Shengfeng Ye, T. Wang, W. L. Xiao, Wei An, Xianzu Wang, Xiaowen Sun, Xiaoxiang Wang, Ying Tang, Yukun Zha, Zekai Zhang, Zhe Ju, Zhen Zhang, Zihua Qu

机构 * DeepSeek-AI

专题命中 工具调用 :agent(abstract);tool-use(abstract);agentic(abstract);分类 cs.CL

AI总结 DeepSeek-V3.2通过高效注意力机制、强化学习框架和大规模代理任务合成流水线,在计算效率与推理能力上取得突破,超越GPT-5并获国际竞赛金牌。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.04683 2025-11-10 cs.DL cs.AI cs.CY 77%

AI-Powered Citation Auditing: A Zero-Assumption Protocol for Systematic Reference Verification in Academic Research

L. J. Janse van Rensburg

机构 * University of Johannesburg(约翰内斯堡大学)

专题命中 工具调用 :agent(abstract);tool-use(abstract);agentic(abstract);分类 cs.AI

Comments 10 pages, 1 table. Code and validation data available at https://github.com/leonjvr/ai-citation-auditor

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18798 2025-10-22 cs.CL 77%

WebSeer: Training Deeper Search Agents through Reinforcement Learning with Self-Reflection

Guanzhong He, Zhen Yang, Jinxin Liu, Bin Xu, Lei Hou, Juanzi Li

机构 * Tsinghua University(清华大学)

专题命中 工具调用 :agent(abstract);tool-use(abstract);agentic(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.21595 2025-09-01 cs.AI 77%

Scalable Solution Methods for Dec-POMDPs with Deterministic Dynamics

Yang You, Alex Schutz, Zhikun Li, Bruno Lacerda, Robert Skilton, Nick Hawes

专题命中 工具调用 :agent(abstract);planning(abstract);multi-agent(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.23554 2025-08-01 cs.AI 77%

DICE: Dynamic In-Context Example Selection in LLM Agents via Efficient Knowledge Transfer

Ruoyu Wang, Junda Wu, Yu Xia, Tong Yu, Ryan A. Rossi, Julian McAuley, Lina Yao

机构 * UNSW Sydney(新南威尔士大学悉尼分校) UC San Diego(南加州大学圣地亚哥分校) Adobe Research(Adobe研究) CSIRO’s Data 61(澳大利亚联邦科学与工业研究组织的数据61)

专题命中 工具调用 :agent(abstract);tool-use(abstract);agentic(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏