arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 5047 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 5047 篇

2602.18764 2026-03-06 cs.AI cs.CL 66%

The Convergence of Schema-Guided Dialogue Systems and the Model Context Protocol

模式引导对话系统与模型上下文协议的收敛

Andreas Schlapbach

机构 * SBB-IT

专题命中 工具调用 :agent(abstract,comments);分类 cs.AI、cs.CL

AI总结 本文通过分析模式引导对话系统与模型上下文协议的收敛,提出五条模式设计原则,揭示了SGD与MCP的内在联系及软件3.0中的关键监督机制。

Comments 18 sections, 4 figures, 7 tables, 40 references. Original research presenting: (1) formal framework mapping Schema-Guided Dialogue principles to Model Context Protocol concepts, (2) five foundational design principles for LLM-native schema authoring, (3) architectural patterns for secure, scalable agent orchestration. Research supported by SBB (Swiss Federal Railways)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.15041 2025-11-27 cs.AI cs.LG cs.SY eess.SY 66%

Earth Observation Satellite Scheduling with Graph Neural Networks and Monte Carlo Tree Search

地球观测卫星调度与图神经网络及蒙特卡洛树搜索

Antoine Jacquet, Guillaume Infantes, Emmanuel Benazera, Vincent Baudoui, Jonathan Guerra, Stéphanie Roussel

专题命中 工具调用 :planning(abstract,comments);分类 cs.AI、cs.LG

AI总结 本文提出利用图神经网络和深度强化学习结合蒙特卡洛树搜索,解决地球观测卫星调度问题,以提高调度效率和效益。

Comments Accepted at International Workshop on Planning & Scheduling for Space (IWPSS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.00277 2025-04-02 cs.AI cs.DC cs.LG cs.NI math.OC 66%

Rack Position Optimization in Large-Scale Heterogeneous Data Centers

Chang-Lin Chen, Jiayu Chen, Tian Lan, Zhaoxia Zhao, Hongbo Dong, Vaneet Aggarwal

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.LG;planning(comments)

Comments Extended version of paper accepted at The International Conference on Automated Planning and Scheduling (ICAPS) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.04935 2024-06-10 cs.AI cs.LG 66%

SLOPE: Search with Learned Optimal Pruning-based Expansion

Davor Bokan, Zlatan Ajanovic, Bakir Lacevic

专题命中 工具调用 :planning(abstract,comments);分类 cs.AI、cs.LG

Comments presented at the ICAPS 2024 workshop on Bridging the Planning and Reinforcement Learning

详情

展开后加载摘要…

URL PDF HTML 收藏
2108.00978 2021-08-03 cs.AI cs.LG cs.RO 66%

Constrained Shortest Path Search with Graph Convolutional Neural Networks

Kevin Osanlou, Christophe Guettier, Andrei Bursuc, Tristan Cazenave, Eric Jacopin

专题命中 工具调用 :planning(abstract,journal_ref);分类 cs.AI、cs.LG

Journal ref AAAI - ICML / IJCAI / AAMAS 2018 Workshop on Planning and Learning (PAL-18). Stockholm, Sweden 2018

详情

展开后加载摘要…

URL PDF HTML 收藏
2010.06460 2020-10-14 cs.AI cs.LG physics.flu-dyn physics.soc-ph 66%

Deep Reinforcement Learning for Real-Time Optimization of Pumps in Water Distribution Systems

Gergely Hajgató, György Paál, Bálint Gyires-Tóth

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.LG;planning(journal_ref)

Journal ref Journal of Water Resources Planning and Management, Volume 146, Issue 11 (November 2020)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06982 2025-12-12 cs.LG cs.SY eess.SY 65%

LLM-Driven Composite Neural Architecture Search for Multi-Source RL State Encoding

基于大语言模型的多源强化学习状态编码复合神经架构搜索

Yu Yu, Qian Xie, Nairen Cao, Li Jin

机构 * Shanghai Jiao Tong University(上海交通大学) Cornell University(康奈尔大学) New York University(纽约大学)

专题命中 工具调用 :agent(abstract,comments);分类 cs.LG;planning(comments)

AI总结 本文提出基于大语言模型的复合神经架构搜索方法,用于多源强化学习状态编码,通过高效搜索发现更高性能的编码器架构。

Comments NeurIPS 2025 Workshop on Bridging Language, Agent, and World Models for Reasoning and Planning

详情

展开后加载摘要…

URL PDF HTML 收藏
1007.0776 2012-04-18 cs.AI cs.CC cs.GT 65%

Is Computational Complexity a Barrier to Manipulation?

Toby Walsh

专题命中 工具调用 :tool use(abstract);分类 cs.AI;agent(comments);multi-agent(comments)

Comments To appear in Proceedings of 11th International Workshop on Computational Logic in Multi-Agent Systems (CLIMA XI 2010)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17381 2026-08-19 q-bio.QM cs.AI cs.LG q-bio.BM 新提交 62%

Leveraging generative hallucination and biophysics-informed modeling for unified biomolecular sequence-structure co-design

利用生成式幻觉和生物物理引导建模实现统一的生物分子序列-结构协同设计

Xuefeng Liu, Mingxuan Cao, Xiao Luo, Songhao Jiang, Tobin Sosnick, Jinbo Xu, Louis Maher, Rick Stevens

专题命中 工具调用 :planning(abstract);分类 cs.AI、cs.LG

AI总结 研究针对DNA/RNA等生物分子设计难题,提出MCTH框架,通过蒙特卡洛树搜索实现序列-结构协同设计,在多模态设计任务中性能优于基线,且可跨模态泛化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07531 2026-08-19 cs.CL cs.AI 版本更新 62%

Search-G1: Grounded Search Agents via Representation-Based Intrinsic Rewards

Search-G1:基于表征内在奖励的接地搜索智能体

Ruoxi Cheng, Haoxuan Ma, Hongyi Zhang, Junming Zhang, Ranjie Duan, Qiaolin Xia, Hao Wang, Yu Lu, Haibo Shi, Xingjun Ma

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.CL

AI总结 该研究提出Search-G1框架,通过两个经干预校准的读数构成的表征内在奖励,改善了搜索增强语言智能体的接地性与搜索成本的权衡,在多基准和模型规模上验证了其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18747 2026-08-19 cs.IR cs.AI cs.CC cs.CL cs.DB 版本更新 62%

The $\mathbf{P}$-Completeness of Inverted Index Traversal: On the Complexity of Evaluating Boolean Query DAGs

倒排索引遍历的$\mathbf{P}$-完备性:关于布尔查询DAG评估的复杂性

Amir Aavani

机构 * Apple Inc.(苹果公司)

专题命中 工具调用 :AI agent(abstract);分类 cs.AI、cs.CL

AI总结 本文证明基于DAG的布尔查询评估问题是$\mathbf{P}$-完备的,并提出一种稀疏感知算法ComputePN,通过正负对偶表示和DAG记忆化,将评估时间严格限制在$O(|Q| \cdot |U_{\mathit{active}}|)$,避免指数爆炸和全量扫描。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14963 2026-08-18 cs.LG cs.AI cs.HC 新提交 62%

Command-Space Counterfactual Explanations for Pareto-Conditioned Reinforcement Learning

帕累托条件强化学习的命令空间反事实解释

Joanikij Chulev, Hendrik Baier

机构 * Centrum Wiskunde & Informatica (CWI)(数学和计算机科学中心(CWI)) Eindhoven University of Technology(埃因霍温理工大学)

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.LG

AI总结 该研究针对帕累托条件强化学习的帕累托条件网络,提出命令空间反事实解释方法CF-ZOO,通过边界种子方向搜索生成可操作的直观解释。

Comments 11 pages, 3 figures

Journal ref Proceedings of the IJCAI-ECAI 2026 Workshop on Explainable Artificial Intelligence (XAI), Bremen, Germany, August 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14742 2026-08-18 cs.SE cs.LG 新提交 62%

PandasCorpus: A Resource of Real-World Pandas Workflows and Usage Patterns

PandasCorpus:真实世界Pandas工作流与使用模式资源

Syrym Abdikhan, Mazhar Hameed

专题命中 工具调用 :workflow(abstract);分类 cs.LG、cs.SE

AI总结 该研究构建了包含13.9万个Jupyter笔记本的PandasCorpus数据集,分析2015-2025年Pandas工作流特征,为相关研究提供公开资源。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06087 2026-08-18 cs.CL cs.AI 版本更新 62%

LatentSkill: From In-Context Textual Skills to In-Weight Latent Skills for LLM Agents

LatentSkill: 从上下文文本技能到LLM智能体的权重内隐技能

Aofan Yu, Chenyu Zhou, Tianyi Xu, Zihan Guo, Rong Shan, Zhihui Fu, Jun Wang, Weiwen Liu, Yong Yu, Weinan Zhang, Jianghao Lin

机构 * Shanghai Jiao Tong University(上海交通大学) Sun Yat-Sen University(中山大学) Shanghai Innovation Institute(上海创新研究院) OPPO Research Institute(OPPO研究院)

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.CL

AI总结 提出LatentSkill框架,通过预训练超网络将文本技能转换为即插即用的LoRA适配器,将技能知识存储在权重空间而非上下文空间,从而减少预填充令牌并提升性能。

Comments 10 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.16697 2026-08-18 cs.CY cs.AI cs.CL cs.HC 版本更新 62%

From Prompts to Constructs: A Dual-Validity Framework for Large Language Model Research in Psychology

从提示到构念:面向心理学研究的大语言模型双效度框架

Zhicheng Lin

专题命中 工具调用 :tool use(abstract);分类 cs.AI、cs.CL

AI总结 本研究针对大语言模型应用于心理学研究时的测量幻影问题,构建了双效度框架,明确不同研究目标对应的证据要求,强调需开发心理构念的计算类似物而非直接套用人类测量工具。

Journal ref Annu. Rev. Psychol. 2027. 78:2.1-2.26

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12336 2026-08-14 cs.CL cs.AI 新提交 62%

StorySpark: Module-wise Evolutionary Search for Story Premise Generation

StorySpark:面向故事前提生成的模块级进化搜索

Yang Yang, Zining Zhong, Qian Cao, Jindong Li, Boyun Xu, Kaishen Yuan, Menglin Yang, Yutao Yue

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Renmin University of China(中国人民大学) Shandong University(山东大学) Institute of Deep Perception Technology, JITRI(JITRI深度感知技术研究院)

专题命中 工具调用 :planning(abstract);分类 cs.AI、cs.CL

AI总结 针对LLM故事生成中前提构思不足的问题,提出StorySpark模块级进化搜索框架,通过优化叙事模块生成更优质的故事前提,提升下游故事质量与创意性。

Comments 26 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26998 2026-08-12 cs.CR cs.CL cs.LG 版本更新 62%

AgentSnare: Learning to Delay, Divert, and Defuse Autonomous Penetration Agents

AgentSnare:学习延迟、转移和瓦解自主渗透智能体

Ruoyu Wang, Heng Zhao, Renjie Wu, Mengnan Zhao, Zhixuan Chu, Wanyu Lin, Tianhang Zheng

专题命中 工具调用 :agent(abstract);分类 cs.CL、cs.LG

AI总结 AgentSnare是一种轨迹自适应欺骗系统,通过动态构建诱饵环境,吸收渗透智能体工具调用、转移其轨迹并瓦解攻击,在CVE-Bench实验中成功阻止了所有真实目标被利用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09867 2026-08-11 cs.CR cs.AI cs.LG 新提交 62%

Stealing Reasoning Traces from Proprietary LLM APIs

从专有大语言模型API窃取推理轨迹

Alexander Panfilov, David Schmotz, Ilia Shumailov, Luca Beurer-Kellner, Joachim Schaeffer, Ameya Prabhu, Jonas Geiping, Maksym Andriushchenko

专题命中 工具调用 :agentic(abstract);分类 cs.AI、cs.LG

AI总结 该研究发现专有LLM API的加密推理轨迹存在跨会话、用户及模型的兼容性漏洞,开发了可扩展解密越狱方法,能提取模型推理、窃取PII等,还提出了对应缓解措施。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01548 2026-08-11 cs.AI cs.LG 版本更新 62%

Emergence Invariance: From Symbolized Thought to Structural Control

涌现不变性:从符号化思维到结构控制

Yi Liu

专题命中 工具调用 :tool use(abstract);分类 cs.AI、cs.LG

AI总结 该研究形式化了语言为核心的智能的限制,提出动态边界控制框架,通过DeepSeek V4-Flash实验验证其可提升大语言模型的推理性能,组织了大语言模型的涌现限制。

Comments 51 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23426 2026-08-11 cs.AI cs.LG 版本更新 62%

ToolUniverse: An open platform for democratizing AI scientists

ToolUniverse:一个让AI科学家开发民主化的开放平台

Shanghua Gao, Richard Zhu, Pengwei Sui, Zhenglun Kong, Sufian Aldogom, Yepeng Huang, Ayush Noori, Reza Shamji, Krishna Parvataneni, Theodoros Tsiligkaridis, Marinka Zitnik

机构 * Department of Biomedical Informatics, Harvard Medical School(哈佛医学院生物医学信息学系) Harvard College, Harvard University(哈佛大学哈佛学院) Massachusetts Institute of Technology(麻省理工学院) MIT Lincoln Laboratory(MIT林肯实验室) Kempner Institute for the Study of Natural and Artificial Intelligence, Harvard University(哈佛大学自然与人工智能研究学院) Broad Institute of MIT and Harvard(MIT与哈佛联合广谱研究所) Harvard Data Science Initiative(哈佛数据科学计划)

专题命中 工具调用 :agentic(abstract);分类 cs.AI、cs.LG

AI总结 ToolUniverse是支持从各类模型构建AI科学家的开放平台,通过AI-工具交互标准规范工具调用,已应用于大量科学工具,案例中可完成多领域端到端分析。

Comments https://aiscientist.tools

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04565 2026-08-06 cs.CR cs.AI cs.CL 新提交 62%

Breadcrumbing Search Agents

面包屑式搜索智能体

Xuebin Li, Hanqing Zhao, Siyuan Liang, Kejiang Chen, Weiming Zhang, Dacheng Tao, Nenghai Yu

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.CL

AI总结 该研究针对LLM搜索智能体的安全问题,提出ACH和TGSE策略,通过操纵搜索结果形成连贯证据链,大幅提升攻击成功率。

Comments 38 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28566 2026-08-06 cs.AI cs.LG 版本更新 62%

Tree of Thoughts as a Classical Heuristic Search Problem: Formal Foundations and Design Patterns

思维树作为经典启发式搜索问题:形式化基础与设计模式

Guni Sharon

机构 * Guni Sharon

专题命中 工具调用 :planning(abstract);分类 cs.AI、cs.LG

AI总结 本文通过经典启发式搜索术语统一分类法,将基于LLM的推理映射到搜索组件,并识别出系统搜索和前瞻性策略两种设计模式。

Comments Extended version of the SoCS 2026 paper. Includes appendices omitted from the proceedings version

Journal ref Proceedings of the Nineteenth International Symposium on Combinatorial Search (SoCS 2026), AAAI Press, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27882 2026-08-06 cs.CL cs.AI 版本更新 62%

VibeSearchBench: Benchmarking Long-horizon Proactive Search in the Wild

VibeSearchBench:野外长期主动搜索的基准测试

Xiaohongshu Inc

机构 * Xiaohongshu Dots Studio & Unipat AI(小红书 dots 飞 studios 与 Unipat AI)

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.CL

AI总结 针对现有搜索基准中查询过于明确、单轮交互和固定模式评估导致用户体验与评估结果差距的问题,提出VibeSearch范式并构建VibeSearchBench基准,通过渐进式用户模拟和图匹配评估框架测试前沿模型,发现所有模型在长期上下文推理、主动意图激发和结构化知识构建方面仍存在显著不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14636 2026-08-05 cs.LG cs.AI 版本更新 62%

When Search Teaches Style: Causal Internalization of Tactical Priors in AlphaZero

AlphaZero-Edu:普及AlphaZero的访问

Ruitong Li, Binjie Guo, Aisheng Mo, Guowei Su, Han Wang, Jie Li, Ru Zhang

机构 * Department of Communication Studies, School of Communication, Hong Kong Baptist University(通讯学院传播研究系,香港 Baptist 大学) Department of Neurobiology and Department of Rehabilitation Medicine, First Affiliated Hospital, Zhejiang University School of Medicine(神经生物学系和康复医学系,浙江大学医学院第一附属医院) Personal participation(个人参与)

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出AlphaZero-Edu,一种轻量级教育导向的实现,通过模块化架构和高效训练,提升AlphaZero的可访问性和可重复性,实现单GPU训练和并行自对弈加速。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20381 2026-08-05 cs.CL cs.AI cs.HC 版本更新 62%

The production of meaning in the processing of natural language

自然语言处理中意义产生的机制

Christopher J. Agostino, Quan Le Thien, Nayan D'Souza, Louis van der Elst

机构 * Department of Physics, Indiana University(印第安纳大学物理系) Department of Linguistics, Indiana University(印第安纳大学语言学系) Imperial College London(伦敦帝国学院)

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.CL

AI总结 研究自然语言处理中意义产生的机制,探讨量子逻辑与经典布尔理论在语义处理中的差异,分析模型在不同参数下的表现及对安全交互的影响。

Comments Accepted to QNLP 2026, 9 pages, 3 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.11482 2026-08-05 cs.AI cs.CL 62%

Meta Prompting for AI Systems

为AI系统引入元提示

Yifan Zhang, Yang Yuan, Andrew Chi-Chih Yao

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.CL

AI总结 通过元提示框架提升大语言模型的推理能力,实现高效的问题解决与自我优化。

Comments Project Page: https://github.com/meta-prompting/meta-prompting

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02583 2026-08-04 cs.CV cs.AI cs.CL cs.IR 新提交 62%

UEmbed: Unified Sparse and Dense Multimodal Embeddings

UEmbed:统一稀疏与稠密多模态嵌入

Tingyu Song, Mingxin Li, Yanzhao Zhang, Dingkun Long, Pengjun Xie, Zhijie Nie, Yilun Zhao, Shu Wu

机构 * CASIA(中国科学院自动化研究所) Alibaba Group(阿里巴巴集团) University of Chinese Academy of Sciences(中国科学院大学) Yale University(耶鲁大学)

专题命中 工具调用 :agentic(abstract);分类 cs.AI、cs.CL

AI总结 UEmbed是一种仅解码器的多模态嵌入模型,可单次前向传播生成稀疏与稠密表示,在MMEB-v2和BEIR上表现优异,统一了两类嵌入并支持多模态智能体应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01913 2026-08-04 cs.AI cs.CL cs.IR 新提交 62%

Diagnosing Search Behavior and Failure Modes in Long-Horizon Search Agents

长视野搜索智能体的搜索行为与失败模式诊断

Qi Liu, Jiaxin Mao, Fengbin Zhu, Tat-Seng Chua

机构 * Renmin University of China(中国人民大学) National University of Singapore(新加坡国立大学)

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.CL

AI总结 本研究通过轨迹级诊断区分长视野搜索智能体的检索与利用差距,发现搜索努力与答案质量弱相关,为优化深度研究系统提供了查询构建、证据管理等方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01056 2026-08-04 cs.AI cs.CL 新提交 62%

Control Under Compression: Reliability Frontiers for Tool-Using Agents

压缩下的控制:使用工具的智能体的可靠性边界

Yinghan Hou, Zongyou Yang

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.CL

AI总结 研究针对工具使用智能体的控制上下文压缩,提出CompressAgent基准,揭示压缩的非线性可靠性边界,发现压缩会引发工具执行等错误,需以可执行结果评估压缩效果。

Comments 12 pages, 5 figures; includes an appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07050 2026-08-04 cs.CL cs.LG 版本更新 62%

When Top-K Misses the Decision: Tool-Call Drift in Multi-Teacher On-Policy Distillation

多教师在线策略蒸馏中的行为杠杆不平衡

Jiabin Shen, Guang Chen, Chengjun Mao

机构 * AntGroup(蚂蚁集团)

专题命中 工具调用 :tool-use(abstract);分类 cs.CL、cs.LG

AI总结 研究多教师在线策略蒸馏中行为杠杆不平衡问题,提出Soft Clamp方法,通过校准令牌级散度,减少模型过度调用工具情况,在保持决策准确率的同时,降低工具调用循环和重复调用,提升多教师OPD效果。

Comments 33 pages, 5 figures. Code and aggregate artifacts: https://github.com/shen-jiabin/topk-support-opd

详情

展开后加载摘要…

URL PDF HTML 收藏