arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 3128 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 多智能体 515 篇

2506.18942 2026-06-26 cs.CY q-fin.RM 版本更新 67%

Advanced Applications of Generative AI in Actuarial Science: Case Studies Beyond ChatGPT

生成AI在精算科学中的高级应用:超越ChatGPT的案例研究

Simon Hatzesberger, Iris Nonneman

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文通过四个案例研究探讨生成AI在精算实践中的潜力,涵盖从早期神经网络到现代Transformer生成AI系统的发展,展示其在索赔预测、市场比较、车辆损坏分类及代码迁移中的应用,同时讨论监管与安全挑战。

Comments v3: Minor revision in response to peer review. Methodological and reproducibility refinements across the case studies and the governance section

Journal ref European Actuarial Journal (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05497 2026-06-23 cs.RO 版本更新 67%

Safe-SAGE: Social-Semantic Adaptive Guidance for Safe Engagement through Laplace-Modulated Poisson Safety Functions

Safe-SAGE: 通过拉普拉斯调制泊松安全函数实现安全交互的社会-语义自适应引导

Lizhi Yang, Ryan M. Bena, Meg Wilkinson, Gilbert Bahati, Andy Navarro Brenes, Ryan K. Cosner, Aaron D. Ames

机构 * Caltech MCE(Caltech机械工程系) Tufts ME(Tufts大学机械工程系)

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 提出Safe-SAGE框架,结合泊松安全函数与拉普拉斯引导场,融合多传感器点云与视觉语义分割,通过多层安全滤波器实现腿式机器人在语义丰富动态环境中的安全导航。

Comments Accepted to the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026). Copyright transferred to IEEE

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14189 2026-06-23 cs.CY 版本更新 67%

AI and the Future of Academic Peer Review

人工智能与学术同行评审的未来

Sebastian Porsdam Mann, Mateo Aboy, Joel Jiehao Seah, Zhicheng Lin, Xufei Luo, Daniel Rodger, Hazem Zohny, Timo Minssen, Julian Savulescu, Brian D. Earp

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文分析同行评审的缺陷,探讨大型语言模型(LLM)如何通过监督辅助提升评审质量、减少偏见,并强调治理选择对AI辅助评审合法性的关键作用。

Comments 34 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03136 2026-06-23 cs.MA cs.GT 版本更新 67%

Distributionally Robust Markov Games with Average Reward

平均奖励的分布鲁棒马尔可夫博弈

Zachary Roch, Yue Wang

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 提出平均奖励准则下的分布鲁棒马尔可夫博弈(DR-MG)框架,通过鲁棒贝尔曼方程证明平稳纳什均衡存在性,设计两种收敛算法,并证明折扣因子趋近1时均衡可近似。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16865 2026-06-19 math.OC cs.SY eess.SY 版本更新 67%

Prescribed-Time Distributed Generalized Nash Equilibrium Seeking

预设时间分布式广义纳什均衡求解

Liraz Mudrik, Isaac Kaminer, Sean Kragelund, Abram H. Clark

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 针对安全关键多智能体系统,提出首个全分布式算法,在用户预设时间T内求解带共享耦合约束的广义纳什均衡问题,采用多速率增益调度解耦观测器、优化与对偶一致性三层耦合。

Comments 12 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06846 2026-06-19 eess.SY cs.SY 版本更新 67%

Decentralized CBF-based Safety Filters for Collision Avoidance of Cooperative Missile Systems with Input Constraints

基于CBF的去中心化安全滤波器:面向输入受限的协同导弹系统碰撞避免

Johannes Autenrieb, Mark Spiller

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 针对多飞行器拦截场景,提出基于鲁棒控制屏障函数的去中心化安全滤波器,通过事件触发和松弛变量优化实现碰撞避免,兼顾计算效率与可扩展性。

Comments 7 pages, 5 figures, accepted for presentation at the 2026 American Control Conference (ACC 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17625 2026-06-19 cs.MA cs.GT 版本更新 67%

Iterative Negotiation and Oversight: A Case Study in Decentralized Air Traffic Management

迭代协商与监督:去中心化空中交通管理案例研究

Jaehan Im, John-Paul Clarke, Ufuk Topcu, David Fridovich-Keil

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 提出一种受监管的去中心化协商框架,通过交易拍卖实现共识,并引入税收式监督机制引导系统效率和公平性,理论保证有限时间终止,案例验证了框架在去中心化空中交通管理中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.01818 2026-06-18 nlin.AO physics.soc-ph 版本更新 67%

Emergent Macro-Criticality from Micro-Critical Agents

从微观临界主体涌现的宏观临界性

Nicolas Bessone, Erwan Plantec

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 通过多智能体系统研究微观临界性如何影响集体行为,发现宏观临界性依赖于交互网络的连接性,而非单个智能体的临界动力学。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05882 2026-06-18 q-fin.TR 版本更新 67%

Market Informedness and Market-Maker Profitability: The Trade-Off Between Adverse Selection and Price Discovery

市场知情度对做市商盈利能力的影响

Konrad Ochędzan, Nino Antulov-Fantulin

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文通过多智能体强化学习框架研究市场知情度对做市商盈利能力的影响,发现知情订单流在低知情市场中导致严重逆向选择风险,但整体上市场知情度提高带来的价格发现效应抵消了逆向选择的负面影响,使做市商盈利能力呈上升趋势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18185 2026-06-18 cs.MA 版本更新 67%

The Dynamics of Policy Gradient in Social Dilemmas with Partner Selection

在有伴侣选择的社交困境中政策梯度的动力学

Benedict Russell, Chin-wing Leung, Paolo Turrini

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文研究了在有伴侣选择的多智能体环境中政策梯度动力学,揭示了伴侣选择如何改变对手分布及奖励景观,并证明在简单规则下促进合作的必要条件是种群方差。

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.06555 2026-06-16 cs.CL cs.AI cs.LG cs.MA 版本更新 67%

It's About Time: Temporal References in Emergent Communication

关于时间:涌现通信中的时间指代

Olaf Lipinski, Adam J. Sobey, Federico Cerutti, Timothy J. Norman

机构 * University of Southampton(索姆塞特大学) The Alan Turing Institute(艾伦·图灵研究所) University of Brescia(布雷西亚大学)

专题命中 多智能体 :agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 研究涌现通信中时间指代缺失问题,发现仅改变损失函数不足,需修改架构(分批方法)才能使时间指代涌现,95%以上代理成功,为提升通信效率奠定基础。

Comments 23 pages main body and 31 pages supplementary material, 9 figures in main body. Code available at https://github.com/olipinski/TRG

Journal ref Journal of Artificial Intelligence Research 86, Article 11 (June 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06162 2026-06-12 cs.MA cs.GT 版本更新 67%

Learning to Contest: Decentralized Robust Fairness in Cooperative MARL via Cross-Attention

学习竞争:通过交叉注意力实现合作多智能体强化学习中的去中心化鲁棒公平性

Can Savcı

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 针对合作多智能体强化学习中公平性易被自私智能体利用的问题,提出基于交叉注意力的去中心化策略CAN,通过推断搭便车者数量并动态调整竞争力度,在分级竞争下实现接近集中式分配的鲁棒公平与效率。

Comments 11 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17149 2026-06-12 eess.SY cs.SY eess.SP 版本更新 67%

Enhancing Energy and Spectral Efficiency in IoT-Cellular Networks via Active SIM-Equipped LEO Satellites

通过有源SIM增强的LEO卫星提升IoT蜂窝网络的能效和频谱效率

Rahman Saadat Yeganeh, Hamid Behroozi, Mohammad Javad Omidi, Mohammad Robat Mili, Eduard A. Jorswieck, Symeon Chatzinotas

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 研究利用安装在卫星太阳能板背面的有源堆叠智能超表面(ASIM)结合速率分割多址(RSMA)和共生无线电网络,通过多顺序处理提升信道增益并抑制干扰,采用BCD-SCA、MA-CSAC和MCPPO三种优化方法,实现高能效和频谱效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10401 2026-06-11 cs.CV 版本更新 67%

CoCoSI: Collaborative Cognitive Map Construction for Spatial Intelligence

CoCoSI: 面向空间智能的协作认知地图构建

Yiming Zhang, Ruoxuan Cao, Zhihang Zhong

机构 * Shanghai Jiao Tong University(上海交通大学) Cornell University(康奈尔大学)

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 提出一种即插即用的多智能体框架,通过协作构建结构化认知地图作为空间记忆,无需修改架构或额外训练即可增强预训练多模态大模型的空间理解能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25979 2026-06-11 cs.GT cs.SY eess.SY 版本更新 67%

Move Over, Prisoner's Dilemma: Colonel Blotto has arrived

让位吧,囚徒困境:Colonel Blotto 来了

Keith Paarporn, Jason R. Marden

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文介绍 Colonel Blotto 博弈框架,综述关键分析与计算结果,并展示其在网络安全、网络防御和多智能体系统中的应用,重点探讨相互依赖的对抗目标、替代获胜规则和多智能体竞争环境三个研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18934 2026-06-11 cs.HC cs.MM 版本更新 67%

Whispering Water: Materializing Human-AI Dialogue as Interactive Ripples

低语之水:将人机对话物化为交互式涟漪

Ruipeng Wang, Tawab Safi, Yunge Wen, Christina Cunningham, Hoi Ling Tang, Behnaz Farahi

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 通过将语音情感转换为激发频率、语义内容输入多智能体LLM系统,以及用对数间距和Bark尺度映射分解合成语音为谐波分量,在物理水面上实现人机对话的物化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04464 2026-06-09 cs.CY econ.GN q-fin.EC 版本更新 67%

Bounded by Risk, Not Capability: Quantifying AI Occupational Substitution Rates via a Tech-Risk Dual-Factor Model

受风险限制而非能力:通过技术-风险双因素模型量化AI职业替代率

Shuyao Gao, Minghao Huang

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文通过技术-风险双因素模型量化AI职业替代率,揭示了职业替代并非瞬间发生,而是渐进过程,并指出算法概率无法涵盖专家受专业责任限制的'机构溢价'。

Comments 32 pages, 4 figures. v2: added link to the reproducibility repository (https://github.com/ShuyaoGao/bounded-risk-oai), updated author email, and updated several references

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24238 2026-06-09 cs.RO 版本更新 67%

Decentralized End-to-End Multi-AAV Pursuit Using Predictive Spatio-Temporal Observation via Deep Reinforcement Learning

基于深度强化学习的去中心化端到端多无人艇追捕

Yude Li, Zhexuan Zhou, Huizhe Li, Yanke Sun, Yenan Wu, Yichen Lai, Yiming Wang, Youmin Gong, Jie Mei

机构 * School of Intelligence Science and Engineering(智能科学与工程学院) Guangdong Key Laboratory of Intelligent Morphing Mechanisms and Adaptive Robotics(广东省智能变形机制与自适应机器人重点实验室) Shenzhen Key Lab for Advanced Motion Control and Modern Automation Equipments(深圳先进运动控制与现代自动化设备重点实验室) Harbin Institute of Technology(哈尔滨工业大学)

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文提出一种去中心化端到端多智能体强化学习框架,通过预测时空观测实现自主空中群体在复杂环境中的追捕,提升捕获效率和协同成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.01804 2026-06-09 cs.MA math.OC 版本更新 67%

Pathfinders in the Sky: Formal Decision-Making Models for Collaborative Air Traffic Control in Convective Weather

天空中的探路者:对流天气下协同空中交通管制的正式决策模型

Jimin Choi, Kartikeya Anand, Husni R. Idris, Huy T. Tran, Max Z. Li

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文通过构建马尔可夫链和决策模型,研究对流天气下探路者操作的多智能体决策问题,分析系统稳态行为、飞行接受行为及探路者选择策略,并基于美国联邦航空管理局数据验证其实际意义。

Journal ref 2025 IEEE 28th International Conference on Intelligent Transportation Systems (ITSC)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17003 2026-06-08 math.OC cs.SY eess.SY 版本更新 67%

Constricting Tubes for Prescribed-Time Safe Control

为指定时间安全控制设计的约束管

Darshan Gadginmath, Ahmed Allibhoy, Fabio Pasqualetti

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文提出了一种约束控制屏障函数框架,用于具有输入约束的控制仿射系统指定时间控制。通过构造一个随时间变化的安全管,从包含初始条件的放松集缩小到目标集,确保在用户指定的截止时间内恢复。框架通过单个仿射约束每时间步,实现可扩展性。

Comments 8 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05127 2026-08-10 cs.LG cs.AI stat.ML 版本更新 62%

SSTQ:Privacy-Preserving Vector Quantization via Subsampled Stochastic TurboQuant

SSTQ:基于子采样随机 TurboQuant 的隐私保护向量量化

Adel Javanmard, David P. Woodruff, Vahab Mirrokni

机构 * University of Southern California(南加州大学) Google Research(谷歌研究院) Carnegie Mellon University(卡内基梅隆大学)

专题命中 多智能体 :agentic(abstract);分类 cs.AI、cs.LG

AI总结 本研究针对分布式优化中隐私保护与通信成本的矛盾,提出 SSTQ 框架,实现了更优的均方误差缩放,在联邦学习任务中展现出良好效用与通信效率。

Comments 42 pages, 4 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.08461 2026-06-23 cs.AI cs.CL cs.NE 版本更新 62%

Emergent Communication in Continuous Worlds: Self-Organisation of Conceptually Grounded Vocabularies at Scale

连续世界中的涌现通信:概念化词汇的大规模自组织

Jérôme Botoko Ekila, Lara Verheyen, Jens Nevens, Katrien Beuls, Paul Van Eecke

机构 * Artificial Intelligence Laboratory, Vrije Universiteit Brussel(自由大学布鲁塞尔人工智能实验室) Faculté d’informatique, Université de Namur(纳慕尔大学计算机学院)

专题命中 多智能体 :autonomous agent(abstract);分类 cs.AI、cs.CL

AI总结 提出一种通用方法,使自主智能体群体通过局部通信涌现出指向环境中任意实体的语言约定,该方法在37个数据集上验证了可扩展性和鲁棒性。

Comments Accepted for publication in Transactions of the Association for Computational Linguistics (TACL)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19792 2026-06-18 cs.CL cs.AI cs.HC 版本更新 62%

LVLMs and Humans Ground Differently in Referential Communication

LVLMs与人类在指称交流中的基础不同

Peter Zeng, Weiling Li, Amie J. Paige, Zhengxiang Wang, Panagiotis Kaliosis, Dimitris Samaras, Gregory Zelinsky, Susan E. Brennan, Owen Rambow

机构 * Department of Computer Science(计算机科学系) Department of Psychology(心理学系) Department of Linguistics(语言学系) Institute for Advanced Computational Science(先进计算科学研究院)

专题命中 多智能体 :AI agent(abstract);分类 cs.AI、cs.CL

AI总结 通过人类与AI配对的多轮指称交流实验,发现LVLMs无法像人类一样利用共同基础生成和解析指称表达,导致交流不畅。

Comments 27 pages, 16 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09831 2026-06-16 cs.AI cs.LG cs.MA cs.SI 版本更新 62%

Interpretation as Linear Transformation: A Cognitive-Geometric Model of Concepts and Meaning

解释作为线性变换:概念与意义的认知几何模型

Chainarong Amornbunchornvej

机构 * National Electronics and Computer Technology Center(国家电子与计算机技术中心)

专题命中 多智能体 :agent(abstract);分类 cs.AI、cs.LG

AI总结 提出一个几何框架,通过线性映射和向量空间建模异构智能体间的概念传递、动机与影响,揭示误解与概念消亡的结构条件,并给出领导力的可达性解释。

Comments The revised draft w.r.t. reviewer comments. The code is at https://github.com/DarkEyes/Cognitive-Geometry

Journal ref Minds and Machines, Volume 36, Issue 3, Article number 36, (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.09788 2026-06-10 cs.MA cs.AI cs.CL cs.HC 版本更新 62%

TinyTroupe: An LLM-powered Multiagent Persona Simulation Toolkit

TinyTroupe:一个基于LLM的多智能体人物模拟工具包

Paulo Salem, Robert Sim, Christopher Olsen, Prerit Saxena, Rafael Barcelos, Yi Ding

机构 * Microsoft Corporation(微软公司) Dipeak Technology(迪佩克技术)

专题命中 多智能体 :autonomous agent(abstract);分类 cs.AI、cs.CL

AI总结 针对现有LLM多智能体系统在细粒度人物模拟方面的不足,提出TinyTroupe工具包,支持详细人物定义和程序化控制,用于行为研究和社会模拟。

Comments 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06659 2026-06-09 cs.LG cs.AI 版本更新 62%

In-Context Reinforcement Learning via Communicative World Models

通过通信世界模型进行上下文强化学习

Fernando Martinez-Lopez, Tao Li, Yingdong Lu, Juntao Chen

机构 * Department of Computer and Information Sciences, Fordham University(福特汉姆大学计算机与信息科学系) Department of Systems Engineering, City University of Hong Kong(香港城市大学系统工程系) IBM Research(IBM研究院)

专题命中 多智能体 :agent(abstract);分类 cs.AI、cs.LG

AI总结 提出CORAL框架,通过将潜在表示学习与控制分离,利用信息代理预训练世界模型并生成通信消息,使控制代理实现零样本适应和样本效率提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00143 2026-08-11 cs.CR cs.AI 版本更新 57%

Symbolic Attack Chain Generation from Atomic Red Team Techniques: An Empirical Study of Predicate Representation Granularity

基于Atomic Red Team技术的符号化攻击链生成:谓词表示粒度的实证研究

Ramya Varunsegar

专题命中 多智能体 :planning(abstract);分类 cs.AI

AI总结 本研究对比九类与五类谓词粒度的AALM,发现粒度对攻击链有效性影响小,81.3%结果一致,高粒度仅提升规划论证的内部结构分辨率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08918 2026-08-03 cs.LG 版本更新 57%

A Machine Learning Surrogate for Component Criticality Ranking in Interdependent Power-Communication Networks

一种用于相互依赖的电力通信网络中组件关键性排序的机器学习代理模型

Sohini Roy, Xheni Hylviu

专题命中 多智能体 :workflow(abstract);分类 cs.LG

AI总结 研究相互依赖的电力通信网络中组件关键性排序问题,基于改进隐含相互依赖模型开发机器学习代理模型,能从结构特征预测故障严重性并排序,在IEEE 118母线系统上表现良好,支持两阶段工作流程。

Comments Accepted for publication in 2026 IEEE International Conference on Communications, Control, and Computing Technologies for Smart Grids (SmartGridComm): Workshop on Cyber-Physical Power System Resilience: Challenges and Emerging Solutions

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24069 2026-07-20 cs.LG cs.DC math.OC 版本更新 57%

Time-varying Mixing Matrix Design for Energy-efficient Decentralized Federated Learning

用于节能分散式联邦学习的时变混合矩阵设计

Xusheng Zhang, Tuan Nguyen, Ting He

专题命中 多智能体 :agent(abstract);分类 cs.LG

AI总结 研究针对无线网络中分散式联邦学习,设计混合矩阵以最小化节点最大能耗。基于新收敛定理提出多阶段设计框架,权衡能耗与收敛速度,平衡节点能耗,经真实数据评估验证了该方案结合稀疏与密集矩阵优势的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.23347 2026-07-09 cs.LG eess.SP 版本更新 57%

Distributed Dynamic Associative Memory via Online Convex Optimization

通过在线凸优化实现分布式动态关联记忆

Bowen Wang, Matteo Zecchin, Osvaldo Simeone

机构 * Department of Engineering, King’s College London(伦敦国王学院工程系) Communication Systems Department, EURECOM(EURECOM通信系统部) Institute for Intelligent Networked Systems (INSI) at Northeastern University London(伦敦东北大学智能网络系统研究所)

专题命中 多智能体 :agent(abstract);分类 cs.LG

AI总结 研究将关联记忆扩展到多智能体及时变数据流场景的分布式动态关联记忆问题,提出基于树的分布式在线梯度下降算法DDAM-TOGD,推导其性能保证并引入优化策略,实验证明该框架在动态分布式环境中有更高准确性和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏