arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 6842 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 多智能体 1139 篇

2606.11284 2026-06-11 cs.MA cs.GT cs.LG 新提交 70%

Phi-Actor-Critic: Steering General-Sum Games to Pareto-Efficient Correlated Equilibria

Phi-Actor-Critic: 引导一般和博弈走向帕累托高效关联均衡

Wongyu Lee, Francesco Lelli, Omran Ayoub, Massimo Tornatore

机构 * Politecnico di Milano(米兰理工大学) Tilburg University(蒂尔堡大学) University of Applied Sciences and Arts of Southern Switzerland(瑞士南瑞士应用科学与艺术大学)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.LG

AI总结 提出Φ-Actor-Critic框架,通过交换遗憾最小化引导多智能体学习向高社会福利的关联均衡收敛,并采用集中式注意力批评家高效估计反事实遗憾,结合拉格朗日均衡选择机制优化社会福利。

Comments Accepted to IJCAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11082 2026-06-10 cs.CL cs.CY 新提交 70%

The Shibboleth Effect: Auditing the Cross-Lingual Distributional Skew of Large Language Models

示播列效应:审计大型语言模型的跨语言分布偏斜

Hakan Mehmetcik

机构 * Kellogg Institute for International Studies, University of Notre Dame(凯洛格国际研究学院,圣约翰大学) Marmara University(马尔马拉大学)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.CL

AI总结 本研究通过多智能体地缘政治兵棋推演,发现前沿LLM在跨语言条件下存在行为偏斜,且该效应依赖于模型架构与训练机制,而非西方起源模型的普遍属性。

Comments 25 pages, 2 figures, 6 tables, Research Article

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10389 2026-06-10 cs.AI 新提交 70%

Beyond Static Evaluation: Co-Evolutionary Mechanisms for LLM-Driven Strategy Evolution in Adversarial Games

超越静态评估:对抗性游戏中LLM驱动策略演化的协同进化机制

Haoran Li, Zengle Ge, Ziyang Zhang, Xiaomin Yuan, Yui Lo, Qianhui Liu, Bocheng An, Dongke Rong, Jiaqun Liu, Annan Li, Jianmin Wu, Dawei Yin, Dou Shen

机构 * Baidu Inc.(百度公司) University of Chinese Academy of Sciences(中国科学院大学) University of California, Los Angeles(加州大学洛杉矶分校) University of Science and Technology of China(中国科学技术大学) Zhejiang University(浙江大学) University of Technology Sydney(悉尼科技大学)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 针对LLM驱动代码进化在对抗性多智能体游戏中因评估景观变化导致停滞的问题,提出评估器协同进化、层次深度评估和弱点压力三种机制,在MCTF任务中实现最优性能和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09632 2026-06-09 cs.CL 新提交 70%

Civil Court Simulation with Large Language Models

基于大型语言模型的民事法庭模拟

Yifan Chen, Haitao Li, Kaiyuan Zhang, Yueyue Wu, Qingyao Ai, Yiqun Liu

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Tsinghua University(清华大学)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.CL

AI总结 提出多智能体民事法庭模拟框架,通过五阶段审判程序、记忆模块和法规检索实现可靠判决,在责任分配和多项裁决上表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08172 2026-06-09 cs.HC cs.AI cs.CY 新提交 70%

The Governance of Human-LLM Interaction: Safety Gating, Civility Steering, and Affective Default Lock-In

人类与LLM交互的治理:安全门控、文明引导与情感默认锁定

Manuele Reani, Hongjian Zhang, Hongyu Tian

机构 * School of Management and Economics, The Chinese University of Hong Kong, Shenzhen, China(管理学院与经济学学院,香港中文大学(深圳))

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本研究通过确定性多智能体评估流水线,测量LLM在长程对话中的提示可引导性和风格漂移,提出区分安全门控、文明引导和情感默认锁定的治理框架,揭示提供商对交互形式的控制对多元性、自主性和民主能动性的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07837 2026-06-09 cs.HC cs.AI 新提交 70%

Does Persona Make LLMs K-pop Fans? A Pilot Study of LLM-Based Online Concert Audience Agents

角色设定会让LLM成为K-pop粉丝吗?基于LLM的在线演唱会观众智能体初步研究

Kirak Kim, Hyojin Kim, Yejin Son, Sungyoung Kim, Kyung Myun Lee

机构 * Graduate School of Culture Technology, KAIST, Daejeon, South Korea(韩国成均馆大学文化科技研究生院) Department of Artificial Intelligence, Yonsei University, Seoul, South Korea(延世大学人工智能系)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 研究通过多智能体系统模拟K-pop演唱会实时粉丝聊天,发现角色设定能提升聊天质量和自然度,但未增强社交连接或情感反应,表明有意义的集体体验需更深层次对齐。

Comments Accepted at the ICML 2026 Workshop on Culture x AI: Evaluating AI as a Cultural Technology

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07790 2026-06-09 cs.LG 新提交 70%

Byzantine Cheap Talk: Adversarial Resilience and Topology Effects in LLM Coordination Games

拜占庭廉价谈话:LLM协调博弈中的对抗韧性与拓扑效应

Aya El Mir, Martin Takáč, Salem Lahlou

机构 * Mohamed bin Zayed University of Artificial Intelligence (MBZUAI)(穆罕默德·本·扎耶德人工智能大学)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.LG

AI总结 研究多智能体LLM在协调博弈中面对拜占庭攻击和通信拓扑限制的脆弱性,发现智能体无法集体适应背叛,且显式限制拓扑会破坏合作,而隐式限制则不影响。

Comments Accepted at NETYS 2026 (The International Conference on Networked Systems)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07697 2026-06-09 physics.ao-ph cs.AI 新提交 70%

TianJi-Environ: An Autonomous AI Scientist for Atmospheric Environmental Research

TianJi-Environ: 用于大气环境研究的自主人工智能科学家

Haoluo Zhao, Hongchun Zhang, Nan Li, Jing-Jia Luo, Kaikai Zhang, Mengyang Yu, Nan Chen, Tao Song, Fan Meng

机构 * School of Artificial Intelligence, Nanjing University of Information Science and Technology(南京信息工程大学人工智能学院) State Key Laboratory of Climate System Prediction and Risk Management (CPRM), Nanjing University of Information Science and Technology(南京信息工程大学气候系统预测与风险管理国家重点实验室) College of Environmental Science and Engineering, Nanjing University of Information Science and Technology(南京信息工程大学环境科学与工程学院) College of Computer Science and Technology, China University of Petroleum(中国石油大学(华东)计算机科学与技术学院)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 提出基于WRF-Chem的多智能体框架TianJi-Environ,自主驱动复杂大气化学模拟,实现机制假设的可执行配置、实验设计和证据标准,并通过臭氧和颗粒物案例验证其可审计的机制验证能力。

Comments 20 pages, 11 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19557 2026-08-21 cs.DC cs.MA 新提交 67%

When Do LLM Agents Help? Deadline-Aware Mixed-Criticality Task Scheduling at the Autonomous-Vehicle Edge

大语言模型智能体何时有用?自动驾驶车辆边缘的感知期限感知混合关键度任务调度

Reza Zakerian

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 该研究针对自动驾驶车辆边缘MEC的混合关键度任务调度,构建强启发式算法,发现LLM控制平面仅在安全关键任务激增时优于静态启发式算法。

Comments 8 pages, 5 figures, and 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18561 2026-08-20 eess.SY cs.SY 新提交 67%

Robust Instability Radius for Networked Dynamical Systems: Upper and Lower Bounds

网络动力系统的鲁棒不稳定性半径:上下界

Shinji Hara, Yutaka Hori, Tetsuya Iwasaki, Chung-Yao Kao, Sei Zhen Khong

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文针对受异质性扰动的多智能体网络系统,研究鲁棒不稳定性半径(RIR),推导其上下界,在网络连接矩阵秩为1等特定条件下可通过小增益论证精确刻画RIR。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18490 2026-08-20 cs.MA 新提交 67%

Bayesian Partner Modelling enables Adaptive Replanning for LLM Coordination

贝叶斯伙伴建模支持大语言模型协同的自适应重规划

Harsh Goel, Aditya Sai Ellendula, Vaishnav Tadiparthi, Ehsan Moradi Pari, Hossein Nourkhiz Mahjoub, Sandeep P. Chinchali

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 该研究针对LLM多智能体协作中伙伴策略变化导致的重规划问题,提出BayesBeliefAgent方法,在Overcooked环境中显著缩小信念-行动差距并减少重规划次数。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18114 2026-08-20 cs.CL cs.AI cs.LG eess.SP q-bio.NC 新提交 67%

Accurate Decoding of Natural Sentences from Non-Invasive Brain Recordings

从非侵入式脑记录中准确解码自然句子

Mingfang Zhang, Jarod Lévy, Cedric Rommel, Jérémy Rapin, Corentin Bel, Julie Bonnaire, Daniel Nieto, Pierre Bourdillon, Svetlana Pinet, Stéphane d'Ascoli, Thomas Moreau, Jean-Rémi King

机构 * Meta AI École Normale Supérieure(高等师范学院) Université PSL(巴黎文理大学) CNRS(法国国家科学研究中心) Hospital Foundation Adolphe de Rothschild(阿道夫·德·罗斯柴尔德医院基金会) Univ. Lille(里尔大学) Basque Center on Cognition, Brain and Language(巴斯克认知、大脑与语言中心) Paris Cité University(巴黎城市大学) Inria(法国国家信息与自动化研究所) Université Paris-Saclay(巴黎萨克雷大学) INSERM(法国国家健康与医学研究院) CEA(法国原子能和替代能源委员会)

专题命中 多智能体 :AI agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本研究提出Brain2Qwerty v2模型,利用MEG记录解码自然句子,平均WER为39%,准确率随数据量提升,通过AI技术缩小非侵入式与颅内脑机接口的性能差距。

Comments Mingfang Zhang and Jarod Lévy contributed equally to this work

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17210 2026-08-19 cs.NI 新提交 67%

An O-RAN-Assisted MARL Approach for Dynamic Sidelink and Infrastructure Selection in V2X Communications

面向V2X通信中动态侧链路与基础设施选择的O-RAN辅助多智能体强化学习方法

Maria Katarine Santana Barbosa, Kelvin Lopes Dias

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 该研究针对6G车联网V2X通信的干扰与资源问题,提出O-RAN辅助的MARL系统,采用聚类与集中训练分布式执行策略,在仅车辆及VRU共存场景下均显著降低损失与延迟。

Comments This paper has been accepted for publication in IEEE Transactions on Vehicular Technology

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15339 2026-08-18 econ.EM 新提交 67%

Learning Sequential Mobility Choice: A Review of Route and Activity Choice through Inverse Reinforcement and Imitation Learning

学习序列出行选择:基于逆强化学习与模仿学习的路径与活动选择综述

Tien Mai

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 本综述构建了将交通选择建模与IRL、IL结合的统一框架,综述多种相关学习方法,提出嵌入行为约束的混合模型可提升出行选择预测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16293 2026-08-18 cs.HC cs.GT cs.SY eess.SY 新提交 67%

Principled Authority Switching for Shared Autonomy in Human-Robot Teams

人机协作团队中共享自主的原则性权限切换

Sandeep Banik, Naira Hovakimyan

专题命中 多智能体 :agent(abstract);autonomous agent(abstract)

AI总结 本文提出一种合作博弈论框架,用于解决人机共享自主中的权限切换问题,推导了线性二次系统下最优切换策略的闭式递推式,验证了其在不同系统场景下的有效性,揭示了人类适应性与自主效率的权衡。

Comments 8 pages, 7 figures, accepted at IEEE RO-MAN 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16199 2026-08-18 cs.NI 新提交 67%

SbDN: Source-based TSN-Grade Deterministic Networking using Commodity Switches

SbDN:使用商用交换机的基于源的TSN级确定性网络

Mohammadparsa Karimi, Majid Nabi, Andrew Nelson, Kees Goossens, Twan Basten

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 该研究提出基于源的多智能体架构SbDN,用商用交换机实现TSN级确定性网络,通过TNP和TP两种方法保证时间关键流的端到端延迟,成本更低且调度时间短。

Comments 20 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16024 2026-08-18 eess.SY cs.SY eess.SP 新提交 67%

Moving Horizon Estimation for Underwater Target Tracking Based on Time-Difference-of-Arrival Measurements

基于到达时间差测量的水下目标跟踪的移动时域估计

Anton Tolstonogov, David Cabecinhas, Pedro Batista, Antonio Pascoal

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文针对水下目标跟踪难题,研究基于到达时间差的移动时域估计方法,仿真显示其鲁棒性优于经典扩展卡尔曼滤波,可作为多智能体跟踪系统的实用组件。

Comments 6 pages, 2 figures. This work has been accepted to IFAC WC 2026 for publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16311 2026-08-18 cs.HC cs.GT cs.SY eess.SY math.DS 新提交 67%

$\texttt{Flip-Team}$: Cooperative Takeover Games with Stochastic Human Override

Flip-Team:带随机人工干预的协作接管游戏

Sandeep Banik, Naira Hovakimyan

专题命中 多智能体 :agent(abstract);autonomous agent(abstract)

AI总结 本文提出带随机人工干预的协作博弈论框架,将共享自主系统的控制切换问题建模为利益一致的动态博弈,推导线性二次系统的最优切换策略闭式递推式,验证了其在不同系统下的有效性,揭示人类适应性与自主效率的权衡。

Comments 8 pages, 7 figures, accepted at IEEE CDC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14085 2026-08-17 cs.CV 新提交 67%

CoDS: Robust Collaborative Perception via Expert-driven Detection and BEV Segmentation

CoDS:基于专家驱动检测与BEV分割的鲁棒协同感知

Jinlong Wang, Yuang Jia, Junhong Lin, Nannan Li, Wei Gao

机构 * Peking University(北京大学) Macau University of Science and Technology(澳门科技大学)

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 针对多源噪声导致协同感知性能下降的问题,提出CoDS框架,通过CoRM、S-MoE和BTCI模块提升鲁棒性,在公开数据集上优于基线且抗噪稳定。

Comments 10 pages, 6 figures

Journal ref ACMMM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12534 2026-08-14 cs.MA cs.RO 新提交 67%

Entropy-Augmented Multi-Objective Policy Optimization in Multiagent Systems

多智能体系统中的熵增强多目标策略优化

Jamie Santos, Ayhan Alp Aydeniz, Raghav Thakar, Kagan Tumer

专题命中 多智能体 :agent(abstract);autonomous agent(abstract)

AI总结 针对多智能体系统中多目标进化算法忽略行为多样性的问题,提出熵增强策略评估方法,在漫游者领域实验中使超体积较NSGA-II提升最高达48%,验证了行为多样性的优化价值。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13535 2026-08-14 eess.SY cs.MA cs.SY math.OC 新提交 67%

Joint Communication-Control Strategy Optimization with Partially Nested Information Structures: The Linear-Quadratic Case

部分嵌套信息结构下的通信与控制策略联合优化:线性二次情形

Haoyi You, Kaiqing Zhang

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文针对多智能体线性系统的JCCO问题,基于CIB框架建立形式化模型,提出基于动态规划的方法求解开环及闭环通信策略下的最优策略,可导出里卡蒂方程并拓展至分散线性二次控制场景。

Comments Preliminary version accepted to IEEE CDC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12256 2026-08-13 eess.SY cs.SY 新提交 67%

SelectLight: Learning to Select Signal Plans Generated by Distributed Model Predictive Control for Urban Traffic Networks

SelectLight:学习选择分布式模型预测控制生成的城市交通网络信号方案

Lyuzhou Luo, Chaopeng Tan, Zhengyong Gao, Hong Zhu, Andrea D'Ariano, Keshuang Tang

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 SelectLight通过MARL策略选择DMPC生成的交通信号方案,在SUMO网络实验中延迟性能最优,需求加倍时排队延迟降低5.57%,求解时间远低于控制间隔。

Comments 37 pages, 14 figures, 13 tables. Submitted to Transportation Research Part C: Emerging Technologies

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11592 2026-08-13 cs.RO 新提交 67%

Video2Track: From Real-World Interaction Videos to Steerable Adversarial Closed-Track Testing for Automated Driving Systems

Video2Track:从真实世界交互视频到自动驾驶系统的可操控对抗性封闭赛道测试

Mengjie Tian, Xinrui Zhang, Tianyu Li, Peizhi Zhang, Guirong Zhou, Haojie Feng, Junpeng Huang, Qixiang Zhang, Lu Xiong

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文提出Video2Track框架,通过两个耦合模块将真实驾驶视频交互场景转化为可操控对抗性封闭赛道测试,可复现实景交互场景并生成可控变体,为ADS验证提供可扩展方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10111 2026-08-12 eess.SY cs.SY 新提交 67%

Complexity of Local Observation Consistency in Discrete-Event Systems

离散事件系统中局部观测一致性的复杂性

Tomáš Masopust

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文研究离散事件系统中局部观测一致性(LOC)与局部重标注观测一致性(LROC)的复杂性,证明非确定性被控对象下二者为PSpace完全问题,确定性被控对象下可多项式时间判定,为相关控制应用提供理论依据。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11071 2026-08-12 math.PR cs.MA 新提交 67%

Scaling Laws for Majority-based Opinion Dynamics in the Presence of Stubborn Agents

存在固执智能体时基于多数意见动态的标度律

Luke Meredith, Arpan Mukhopadhyay

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 该研究探究多智能体系统中固执智能体对意见动态的影响,基于2k-选择规则,发现达到稳态的时间随固执智能体比例存在尖锐相变,边界区域混合时间为多项式级。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09023 2026-08-11 cs.CY 新提交 67%

AI-AI co-creation outperforms human pairs in creative tasks

AI-AI共创在创意任务中优于人类配对

Yingyue Luna Luan, Luning Sun, Yeun Joon Kim, Jindong Wang, Xing Xie

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 该研究通过实验发现,具备互补角色的AI-AI共创在创意任务中优于单一AI和人类配对,证实结构化多智能体AI共创的创造力潜力。

Comments 19 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09894 2026-08-11 cs.GT cs.MA econ.TH math.OC 新提交 67%

Competitive mediator games and urban CAV routing markets

竞争性中介博弈与城市自动驾驶车辆(CAV)路径规划市场

Grzegorz Jamróz

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文针对未来自动驾驶路径规划与驾驶市场,提出竞争性中介博弈,证明特定条件下其均衡为垄断,并探讨相关市场的机制设计问题。

Comments 42 pages, 6 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07170 2026-08-10 eess.SP 新提交 67%

DRL-Based Secure Transmission for Rotatable Antenna-Enabled Low-Altitude ISAC Systems

基于深度强化学习的可旋转天线低空集成感知与通信系统安全传输

Chuan Liu, Hongyi Bian, Wei Gao, Qi Zhang, Yu Yao, Liang Yang, Feng Shu

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文针对配备可旋转天线的低空ISAC系统,联合优化发射波束成形矩阵与天线指向矩阵以最大化最小保密速率,提出MAPPO-T算法,仿真验证其性能优于标准MAPPO算法及传统固定定向天线系统。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07383 2026-08-10 cs.GT cs.MA 新提交 67%

Analyzing the Interaction of Optimal Strategies in Mean-Payoff Bidding Games

分析平均收益竞标博弈中最优策略的相互作用

Shaull Almagor, Guy Avni, Julian Ewaied

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文针对多智能体系统中智能体互动分析的挑战,聚焦两智能体图上的平均收益竞标博弈,分析对抗优化策略的互动,证明特定条件下博弈最终周期性并开发效用计算算法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07295 2026-08-10 cs.MA 新提交 67%

Learning Long-Term Educational Investment Policies under Residential Sorting

居住分类下的长期教育投资政策学习

Honglei Guo, Shuo Chen, Mingjie Bi, Zeyang Sun, Xiaoxi Wang, Yuhan Zhao

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 该研究针对居住分类下公立教育投资分配的公平与效率问题,构建动态多智能体框架,用强化学习得出的政策在模拟中实现了良好的入学机会与公平性平衡,减少了教育领域的社会经济分层。

详情

展开后加载摘要…

URL PDF HTML 收藏