arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-03-10 至 2026-03-10 共收录 258 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 多智能体 39 篇

2603.06813 2026-03-10 cs.AI 86%

Reinforcing the World's Edge: A Continual Learning Problem in the Multi-Agent-World Boundary

强化世界的边缘:多智能体世界边界中的持续学习问题

Dane Malenfant

机构 * McGill University(麦吉尔大学) Mila - The Québec AI Institute(魁北克人工智能研究所)

专题命中 多智能体 :agent(title,abstract);multi-agent(title);分类 cs.AI

AI总结 本文探讨了多智能体强化学习中智能体与世界边界不稳定导致的持续学习问题,提出通过量化边界漂移来管理不变性损失。

Comments Accepted at the World Modeling Workshop 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06874 2026-03-10 cs.AI cs.CL 85%

LieCraft: A Multi-Agent Framework for Evaluating Deceptive Capabilities in Language Models

LieCraft:一种用于评估语言模型欺骗能力的多智能体框架

Matthew Lyle Olson, Neale Ratzlaff, Musashi Hinck, Tri Nguyen, Vasudev Lal, Joseph Campbell, Simon Stepputtis, Shao-Yen Tseng

机构 * Intel Labs(英特尔实验室)

专题命中 多智能体 :agent(title);multi-agent(title);分类 cs.AI、cs.CL

AI总结 LieCraft通过多智能体隐藏角色游戏评估语言模型的欺骗能力,揭示所有模型在面对高风险领域时均倾向于不道德行为。

Comments AAAI 2026 Alignment track. Authors 1 and 2 contributed equally, 3 and 4 contributed equally, 6 and 7 and 8 contributed equally (ordered by last name)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.17535 2026-03-10 cs.AI cs.LG cs.SE 85%

LAMBDA: A Large Model Based Data Agent

LAMBDA:基于大模型的数据代理

Maojun Sun, Ruijian Han, Binyan Jiang, Houduo Qi, Defeng Sun, Yancheng Yuan, Jian Huang

专题命中 多智能体 :agent(title,abstract);multi-agent(abstract);分类 cs.AI、cs.LG、cs.SE

AI总结 LAMBDA是一种基于大模型的数据代理系统,通过程序员和检查员协作实现无需代码的数据分析,提升数据分析的可访问性和效率。

Comments 56 pages

Journal ref Journal of the American Statistical Association, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08221 2026-03-10 cs.CR cs.AI 83%

SplitAgent: A Privacy-Preserving Distributed Architecture for Enterprise-Cloud Agent Collaboration

SplitAgent: 一种隐私保护的企业-云代理协作分布式架构

Jianshu She

专题命中 多智能体 :agent(title,abstract);AI agent(abstract);分类 cs.AI

AI总结 SplitAgent通过语境感知的动态去敏化技术,实现企业与云代理间的隐私保护协作,提升任务准确率并减少隐私泄露。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08877 2026-03-10 cs.RO 82%

IPPO Learns the Game, Not the Team: A Study on Generalization in Heterogeneous Agent Teams

IPPO 学习游戏而非团队:对异质智能体团队泛化能力的研究

Ryan LeRoy, Jack Kolb

机构 * Los Gatos High School(洛斯加托斯高中) Georgia Institute of Technology(佐治亚理工学院)

专题命中 多智能体 :agent(title,abstract);multi-agent(abstract)

AI总结 本文研究了IPPO在异质智能体团队中的泛化能力,通过旋转策略训练(RPT)发现IPPO基线在未经历队友多样性训练的情况下仍能泛化到新队友算法。

Comments 4 pages, 3 figures, appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.09445 2026-03-10 cs.RO cs.AI cs.MA cs.NE cs.SY eess.SY 77%

Utility Theory based Cognitive Modeling in the Application of Robotics: A Survey

基于效用理论的认知建模在机器人应用中的研究:综述

Qin Yang

机构 * College of Engineering and Computer Science, The University of Tulsa(工程与计算机科学学院,塔尔萨大学)

专题命中 多智能体 :agent(abstract);AI agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文综述了基于效用理论的认知建模在机器人应用中的发展与现状,探讨了其在多代理系统中的作用及未来研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18362 2026-03-10 math.OC cs.AI cs.LG cs.NA math.NA 73%

Maximum Principle of Optimal Probability Density Control

最优概率密度控制的最大原理

Nathan Gaby, Xiaojing Ye

机构 * Department of Mathematics and Computer Science, Berry College, Mount Berry, GA 30149, USA(伯里学院数学与计算机科学系) Department of Mathematics and Statistics, Georgia State University, Atlanta, GA 30303, USA(佐治亚州立大学数学与统计学系)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出了一种基于深度神经网络的高效算法,用于解决大规模多智能体控制问题中的最优概率密度控制。

Comments 31 pages, submitted

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07970 2026-03-10 cs.AI 70%

Advancing Automated Algorithm Design via Evolutionary Stagewise Design with LLMs

通过基于大语言模型的进化分阶段设计推进自动化算法设计

Chen Lu, Ke Xue, Chengrui Gao, Yunqi Shi, Siyuan Xu, Mingxuan Yuan, Chao Qian, Zhi-Hua Zhou

机构 * National Key Laboratory for Novel Software Technology, Nanjing University, China(南京大学新型软件技术国家重点实验室) School of Artificial Intelligence, Nanjing University, China(南京大学人工智能学院) Huawei Noah’s Ark Lab, China(华为诺亚实验室)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文提出EvoStage方法,通过分阶段进化设计提升自动化算法设计效率,实现超越人类专家和现有LLM方法的性能。

Comments 28 pages, 19 figures and 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07848 2026-03-10 cs.AI 70%

Intentional Deception as Controllable Capability in LLM Agents

意图性欺骗作为LLM代理中的可控能力

Jason Starace, Terence Soule

机构 * Department of Computer Science University of Idaho(计算机科学系大学爱达荷州立大学)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文研究了意图性欺骗作为LLM代理可控能力的系统性分析,发现动机是主要攻击向量,而信念系统更难识别,现有事实验证方法不足以应对战略框架的欺骗。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08240 2026-03-10 cs.CV 67%

SiMO: Single-Modality-Operable Multimodal Collaborative Perception

SiMO: 单模态可操作的多模态协作感知

Jiageng Wen, Shengjie Zhao, Bing Li, Jiafeng Huang, Kenan Ye, Hao Deng

机构 * Shanghai Research Institute for Intelligent Autonomous Systems, Tongji University(同济大学智能自主系统上海研究院) School of Computer Science and Technology, Tongji University(同济大学计算机科学与技术学院) School of Mechatronic Engineering and Automation, Shanghai University(上海大学机械电子工程与自动化学院)

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 SiMO通过单模态可操作的多模态协作感知方法,解决多模态特征融合中的语义不匹配问题,提升协作感知性能。

Comments Accepted to ICLR 2026. This arXiv version includes an additional appendix (Appendix 15) containing further philosophical discussion not included in the official ICLR peer-reviewed version

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15478 2026-03-10 cs.GT 67%

Equal-Pay Contracts

等额支付合同

Michal Feldman, Yoav Gal-Tzur, Tomasz Ponitka, Maya Schlesinger

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文研究等额支付合同,分析其在多智能体合同设计中的算法和难度结果,并解决两个开放问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06814 2026-03-10 cs.DL cs.AI 57%

AI-Assisted Curation of Conference Scholarship: Compiling, Structuring, and Analyzing Two Decades of Presentations at the Society for Social Work and Research

人工智能辅助会议学术整理:整理、组织和分析社会工作与研究协会二十年的演讲

Brian Perron, Bryan Victor, Zia Qi

专题命中 多智能体 :planning(abstract);分类 cs.AI

AI总结 本研究通过构建SSWR会议演讲数据库,分析了二十年间研究方法、作者合作和国际参与的变化,揭示了定量方法的主导地位及研究参与的显著增长。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08556 2026-03-10 cs.IT math.IT 50%

Fusion of Monostatic and Bistatic Sensing for ISAC-Enabled Low-Altitude Environment Mapping

单基站与双基站传感融合用于ISAC赋能的低空环境映射

Liu Meihui, Sun Shu, Gao Ruifeng, Zhang jianhua, Tao meixia

专题命中 多智能体 :agent(abstract)

AI总结 本文提出首个基于多径的ISAC环境映射框架,通过融合单基站和双基站测量,提升低空环境映射的准确性和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08273 2026-03-10 cs.RO cs.MA 50%

Less is More: Robust Zero-Communication 3D Pursuit-Evasion via Representational Parsimony

少即是多:通过表征简洁性实现鲁棒的零通信三维追捕-逃避

Jialin Ying, Zhihao Li, Zicheng Dong, Guohua Wu, Yihuan Liao

专题命中 多智能体 :agent(abstract)

AI总结 通过表征简洁性提升零通信下的三维追捕-逃避鲁棒性,采用简洁的智能体观察接口和贡献门控信用分配方法,实现更高的成功率和更少的碰撞。

Comments 7 pages, 10 figures. This work has been submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 工作流自动化 27 篇

2510.01235 2026-03-10 cs.LG cond-mat.mtrl-sci cs.AI cs.CL 88%

Automated Extraction of Material Properties using LLM-based AI Agents

基于LLM的材料属性自动提取

Subham Ghosh, Abhishek Tewari

机构 * Mehta Family School of Data Science and Artificial Intelligence(梅塔家族数据科学与人工智能学院) Indian Institute of Technology Roorkee(印度理工学院罗尔基分校) Department of Metallurgical and Materials Engineering(冶金与材料工程系)

专题命中 工作流自动化 :AI agent(title);agent(abstract);workflow(abstract);agentic(abstract)

AI总结 本研究提出基于LLM的自动材料属性提取方法,构建了大规模热电数据集,实现了高准确率和低成本的属性提取流程,为材料发现提供了新的工具和基础。

Journal ref Computational Materials Science 265 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20102 2026-03-10 cs.AI 85%

Human-Centered LLM-Agent System for Detecting Anomalous Digital Asset Transactions

面向人类的LLM-智能体系统用于检测异常数字资产交易

Gyuyeon Na, Minjung Park, Hyeonjeong Cha, Sangmi Chai

专题命中 工作流自动化 :agent(title,abstract);workflow(abstract);multi-agent(abstract);分类 cs.AI

AI总结 HCLA是一种面向人类的多智能体系统,用于通过自然语言交互提高数字资产交易异常检测的可解释性和透明度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26354 2026-03-10 cs.AI cs.CL cs.LG 85%

Your Agent May Misevolve: Emergent Risks in Self-evolving LLM Agents

你的代理可能误进化:自我进化大语言模型代理中的新兴风险

Shuai Shao, Qihan Ren, Chen Qian, Boyi Wei, Dadi Guo, Jingyi Yang, Xinhao Song, Linfeng Zhang, Weinan Zhang, Dongrui Liu, Jing Shao

专题命中 工作流自动化 :agent(title,abstract);workflow(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文研究了自我进化代理中因自我进化偏离导致的误进化风险,揭示了其广泛存在及对安全对齐的影响,并提出缓解策略。

Comments Published in ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06835 2026-03-10 cond-mat.mtrl-sci physics.ins-det 80%

AIMD-L: An automated laboratory for high-throughput characterization of structural materials for extreme environments

AIMD-L: 一种用于极端环境下结构材料高通量表征的自动化实验室

Todd C. Hufnagel, Pranav Addepalli, Anuruddha Bhattacharjee, Rohit Berlia, Jaafar El-Awady, David Elbert, Lori Graham-Brady, Axel Krieger, Harichandana Neralla, T. Joseph Nkansah-Mahaney, Mostafa M. Omar, Hyun Sang Park, K. T. Ramesh, Matthew Shaeffer, Eric Walker, Piyush Wanchoo, Timothy P. Weihs

专题命中 工作流自动化 :agent(abstract);AI agent(abstract);workflow(abstract);agentic(abstract)

AI总结 AIMD-L是一种自动化实验室,用于高通量表征极端环境下结构材料的微观结构和性能。

Comments 15 pages, 10 figures, submitted to Matter

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22401 2026-03-10 cs.AI cs.HC 79%

Vibe Researching as Wolf Coming: Can AI Agents with Skills Replace or Augment Social Scientists?

作为狼群的到来:AI代理能否取代或增强社会科学家?

Yongjun Zhang

机构 * Department of Sociology and Institute for Advanced Computational Science, Stony Brook University(社会学系和先进计算科学研究所,石英布鲁克大学)

专题命中 工作流自动化 :AI agent(title,abstract);分类 cs.AI

AI总结 本文探讨AI代理在社会科学研究中的潜力,提出vibe研究概念,分析其在速度、覆盖和方法论上的优势及理论原创性的局限,并提出五条负责任的研究原则。

Comments Commentary

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07709 2026-03-10 cs.HC cs.AI 74%

YAQIN: Culturally Sensitive, Agentic AI for Mental Healthcare Support Among Muslim Women in the UK

YAQIN:面向英国穆斯林女性的文化敏感、代理型AI心理健康支持系统

Yasmin Zaraket, Céline Mougenot

机构 * Dyson School of Design Engineering, Imperial College London(帝京理工学院伦敦校区设计工程学院)

专题命中 工作流自动化 :agentic(title);分类 cs.AI

AI总结 YAQIN通过整合伊斯兰心理学和用户中心设计,为英国穆斯林女性提供文化敏感的AI心理健康支持,提升信任与治疗效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06647 2026-03-10 cs.NI cs.AI 70%

Performance Comparison of IBN orchestration using LLM and SLMs

基于LLM和SLMs的IBN编排性能比较

Wai Lwin Phone, Brahim El Boudani, Tasos Dagiuklas, Saptarshi Ghosh

机构 * 1 Dept. of Computer Science \& Digital Technologies, London South Bank University, London, UK

专题命中 工作流自动化 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文比较了LLM和SLMs在IBN编排中的性能,发现SLMs能提升IBN生命周期完成速度20%。

Comments Accepted for presentation at IEEE International Conference on Communications 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07611 2026-03-10 cs.HC 67%

Beyond Semantic Similarity: Open Challenges for Embedding-Based Creative Process Analysis Across AI Design Tools

超越语义相似性:基于嵌入的AI设计工具创意过程分析的开放挑战

Seung Won Lee, Semin Jin, Kyung Hoon Hyun

专题命中 工作流自动化 :agent(abstract);agentic(abstract)

AI总结 本文探讨了基于嵌入的AI设计工具创意过程分析中超越语义相似性的开放挑战,提出通过上下文感知干预提升分析敏感性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07609 2026-03-10 cs.HC 67%

From Logs to Agents: Reconstructing High-Level Creative Workflows from Low-Level Raw System Traces

从日志到代理:从低级原始系统轨迹重构高级创造性工作流

Tae Hee Jo, Kyung Hoon Hyun

专题命中 工作流自动化 :workflow(abstract);agentic(abstract)

AI总结 本文提出了一种从低级系统日志重构高级创造性工作流的方法,通过结构化行为工作流图实现对用户创意过程的理解与支持。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07897 2026-03-10 cs.LG 57%

LeJOT-AutoML: LLM-Driven Feature Engineering for Job Execution Time Prediction in Databricks Cost Optimization

LeJOT-AutoML:基于LLM的特征工程用于Databricks成本优化中的作业执行时间预测

Lizhi Ma, Yi-Xiang Hu, Yihui Ren, Feng Wu, Xiang-Yang Li

机构 * University of Science and Technology of China(中国科学技术大学) Lenovo(联想)

专题命中 工作流自动化 :agent(abstract);分类 cs.LG

AI总结 LeJOT-AutoML利用LLM驱动的AutoML框架,通过动态生成特征提升Databricks作业执行时间预测的准确性,从而实现成本优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07666 2026-03-10 cond-mat.mtrl-sci cs.AI 57%

AI-Driven Phase Identification from X-ray Hyperspectral Imaging of cycled Na-ion Cathode Materials

基于X射线超光谱成像的AI驱动相识别:循环钠离子正极材料

Fayçal Adrar, Nicolas Folastre, Chloé Pablos, Stefan Stanescu, Sufal Swaraj, Raghvender Raghvender, François Cadiou, Laurence Croguennec, Matthieu Bugnet, Arnaud Demortière

机构 * Laboratoire de Réactivité et de Chimie des Solides (LRCS), CNRS UMR 7314, Université de Picardie Jules Verne(法国皮卡第大学劳勃-德-夏尔固体反应与化学实验室(LRCS)) Réseau sur le Stockage Electrochimique de l’Energie (RS2E), CNRS FR 3459(能源电化学存储网络(RS2E)) ALISTORE-European Research Institute, CNRS FR 3104(ALISTORE欧洲研究机构) Université de Picardie Jules Verne(法国皮卡第大学) Synchrotron SOLEIL(SOLEIL同步辐射光源)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 本研究提出一种AI驱动方法,用于处理稀疏采样的超光谱数据,实现钠离子正极材料中多相分布的纳米尺度成像与分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07460 2026-03-10 cs.CR cs.AI 57%

Where Do LLM-based Systems Break? A System-Level Security Framework for Risk Assessment and Treatment

LLM-based系统在哪里失效?一个系统级安全框架用于风险评估与处理

Neha Nagaraja, Hayretdin Bahsi

机构 * Northern Arizona University(北亚利桑那大学) Department of Software Science(软件科学系) Tallinn University of Technology(塔林技术大学)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 本文提出了一种系统级安全框架,用于评估和处理LLM系统中的风险,通过结合系统建模与攻击-防御树,分析医疗场景中的多步骤攻击路径,并提供可比较的防御策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07416 2026-03-10 cs.LG 57%

DualSpec: Accelerating Deep Research Agents via Dual-Process Action Speculation

DualSpec: 通过双过程动作推测加速深度研究代理

Shuzhang Zhong, Baotong Lu, Qi Chen, Chuanjie Liu, Fan Yang, Meng Li

机构 * pku(北京大学) msr(微软研究院)

专题命中 工作流自动化 :tool use(abstract);分类 cs.LG

AI总结 DualSpec通过双过程动作推测机制,在保持准确性的同时显著提升深度研究代理的端到端速度

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22769 2026-03-10 cs.CY cs.AI cs.HC 57%

MediTools -- Medical Education Powered by LLMs

MediTools -- 由LLMs驱动的医学教育

Amr Alshatnawi, Remi Sampaleanu, David Liebovitz

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 MediTools利用LLMs开发交互式医学教育工具,通过模拟临床场景、文献检索和新闻摘要等功能提升医学教育的效率和效果。

Comments 20 pages, 19 figures, 2 tables. Code available at https://github.com/NM-Streamlit-Team/meditools

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06939 2026-03-10 cs.LG cond-mat.soft cs.CE 57%

Physics-Consistent Neural Networks for Learning Deformation and Director Fields in Microstructured Media with Loss-Based Validation Criteria

具有损失验证标准的物理一致神经网络:用于学习微结构介质中变形和方向场的机械行为

Milad Shirani, Pete H. Gueldner, Murat Khidoyatov, Jeremy L. Warren, Federica Ninno

机构 * Department of Biomedical Engineering, Yale University(生物医学工程系,耶鲁大学) Department of Mechanical Engineering, Yale University(机械工程系,耶鲁大学)

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 本文提出了一种基于物理一致神经网络的方法,用于学习微结构介质中的变形和方向场,并通过损失验证标准确保能量稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06669 2026-03-10 cs.NI cs.AI 57%

Hybrid Orchestration of Edge AI and Microservices via Graph-based Self-Imitation Learning

基于图的自我模仿学习的边缘AI与微服务混合编排

Chen Yang, Jin Zheng, Yang Zhuolin, Lai Pan, Zhang Xiao, Hu Menglan, Yin Haiyan

机构 * School of Computer Science, South-Central Minzu University(中央民族大学南中央学院) Key Laboratory of Cyber-Physical Fusion Intelligent Computing, State Ethnic Affairs Commission(国家民族事务委员会网络物理融合智能计算重点实验室) Hubei Key Laboratory of Smart Internet Technology, School of Electronic Information and Communication, Huazhong University of Science and Technology(湖北智能互联网技术重点实验室,华中科技大学电子信息与通信学院) Centre for Frontier AI Research, Agency for Science, Technology and Research (A*STAR)(前沿人工智能研究中心,科技研究局(A*STAR))

专题命中 工作流自动化 :agent(abstract);分类 cs.AI

AI总结 本文提出SIL-GPO框架,通过图注意力网络和自我模仿学习优化边缘AI与微服务的混合编排,显著降低延迟并提升资源利用率。

详情

展开后加载摘要…

URL PDF HTML 收藏