arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-06-02 至 2026-06-02 共收录 432 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 多智能体 72 篇

2606.00266 2026-06-02 cs.NI cs.LG 70%

KISS: Keeping it Simple and Slotted when Learning to Communicate over Wireless

KISS:学习无线通信时保持简单和时隙化

Kamil Szczech, Maksymilian Wojnar, Krzysztof Rusek, Katarzyna Kosek-Szott, Szymon Szott

机构 * AGH University of Krakow(克拉科夫AGH大学)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.LG

AI总结 本文使用离线双深度Q网络结合贝叶斯推理,在时隙信道上训练分布式智能体自主学习随机接入策略,实现了接近理论效率且公平的接入,并发现学习到的行为类似于动态调整传输概率的时隙ALOHA。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00008 2026-06-02 cs.AI 70%

Agents on a Tree: Pathwise Coordination for Multi-Objective Molecular Optimization

树上的智能体:多目标分子优化的路径协调

Jia Zhang, Tengfei Ma, Tianle Li, Daojian Zeng, Xieping Gao, Xiangxiang Zeng

机构 * College of Information and Science(信息科学学院) Hunan Normal University(湖南师范大学) College of Computer Science(计算机科学学院) Electronic Engineering, Hunan University(电子工程学院,湖南大学)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 提出ATOM多智能体框架,将分子优化建模为树结构搜索,通过路径协调实现多目标权衡,在活性、可合成性和ADMET相关性质上优于基线。

Comments 17 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30190 2026-06-02 cs.LG 70%

Mean-Field Diffuser: Scaling Offline MARL to Thousands of Agents

均场扩散器:将离线多智能体强化学习扩展到数千个智能体

Wenhao Li, Xiangfeng Wang, Bo Jin

机构 * Tongji University(同济大学) East China Normal University(华东师范大学)

专题命中 多智能体 :agent(abstract);planning(abstract);分类 cs.LG

AI总结 提出MF-Diffuser框架,通过将轨迹规划提升到轨迹分布的Wasserstein空间,并利用混沌传播和分层粗到细策略,将离线多智能体强化学习扩展到数千个智能体,理论证明均场近似误差为$O(H^2/\sqrt{N})$且离线分布偏移不随群体规模增长,实验在三个均场RL基准上取得最佳回报。

Comments 62 pages, 15 figures, 16 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12741 2026-06-02 cs.AI 70%

Language Model Networks: Supervision-Efficient Learning through Dense Communication

语言模型网络:通过密集通信实现监督高效学习

Shiguang Wu, Yaqing Wang, Quanming Yao

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 提出LMNet,一种密集可微的语言模型网络,通过可训练的序列到序列模块作为通信边,实现节点间密集向量交换,支持端到端梯度优化和高效信息传递,在有限监督下实现有效适应。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05671 2026-06-02 cs.CL 70%

ClinTutor-R1: Advancing Scalable and Robust One-to-Many Alignment in Clinical Socratic Education

ClinTutor-R1:在临床苏格拉底式教育中推进可扩展且稳健的一对多对齐

Zhitao He, Haolin Yang, Zeyu Qin, Yi R Fung

机构 * Hong Kong University of Science and Technology(香港理工大学)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.CL

AI总结 针对临床查房等一对多教学场景中上下文稀释与目标错位问题,提出基于多智能体模拟器ClinEdu构建的苏格拉底式教学数据集ClinTeach,并开发首个显式内部思维机制的一对多对齐视觉语言智能体ClinTutor-R1,通过建模个体信念状态与群体共识,在静态基准、交互评估、专家评审及200人真实用户研究中超越基线模型20%以上,达到与专有模型相当的性能,并展现出随学生规模扩展的教学质量可扩展性。

Comments Accepted by ICML 2026 (Spotlight)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01857 2026-06-02 cs.MA 67%

From Global Policies to Local Strategies: Multi-Objective Optimization of Resource-Specific Handover Policies

从全局策略到局部策略:资源特定切换策略的多目标优化

Lukas Kirchdorfer, Artemis Doumeni, Han van der Aa, Hugo A. López

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 提出结合多智能体系统仿真器与多目标进化算法的方法,生成帕累托最优的资源特定策略,平均降低37%成本和58%等待时间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00416 2026-06-02 cs.CV 67%

4D Radar Meets LiDAR and Camera: Cooperative Perception under Adverse Weather

4D雷达与激光雷达和相机的结合:恶劣天气下的协同感知

Melih Yazgan, Iramm Hamdard, Qiyuan Wu, J. Marius Zoellner

机构 * FZI Research Center for Information Technology(FZI信息技术研究所以) Karlsruhe Institute of Technology(卡尔斯鲁厄大学)

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 针对恶劣天气下相机和激光雷达性能下降的问题,提出集成4D成像雷达作为鲁棒模态,并引入多普勒引导的空间注意力机制进行多智能体融合,显著提升雾雨环境下的协同感知鲁棒性。

Comments Accepted by CVPR - DriveX Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00287 2026-06-02 cs.MA cs.DC 67%

Leveraging the Learning Curve: Reusing Existing Architectural Patterns to Design and Implement MAS

利用学习曲线:重用现有架构模式设计与实现多智能体系统

Arthur Casals, Anarosa A. F. Brandão

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 提出通过将最小智能体概念引入分布式系统领域,利用分布式系统工程技术和已有智能体理论,改进多智能体系统的工程化方法,并通过实践验证其有效性。

Comments Author's accepted manuscript of an article published in IEEE Access. 17 pages, 6 figures. IEEE Access, vol. 13, pp. 45809-45825, 2025. Copyright 2025 IEEE. Personal use of this material is permitted. The final version is available at https://doi.org/10.1109/ACCESS.2025.3546526

Journal ref IEEE Access, vol. 13, pp. 45809-45825, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28334 2026-06-02 cs.CR 67%

Towards Cybersecurity SuperIntelligence (CSI): What's the best harness for cybersecurity?

迈向网络安全超级智能(CSI):什么是网络安全的最佳驾驭方式?

Víctor Mayoral-Vilches, Francesco Balassone, María Sanz-Gómez, Paul Zabalegui Landa, Daniel Sánchez Prieto, Marina Oteiza Álvarez, Davide Quarta, Martin Pinzger

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 提出一种元脚手架(meta-scaffold)统一异构智能体框架,通过黑板架构实现多框架并行协作,在33个cybench挑战中覆盖率达57.6%,相比最佳单一框架提升27%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16296 2026-06-02 eess.SY cs.GT cs.SY 67%

Learning in Stackelberg Markov Games

Stackelberg马尔可夫博弈中的学习

Jun He, Andrew L. Liu, Yihsu Chen

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 研究在动态不确定环境中,单个领导者与自适应跟随者群体学习Stackelberg均衡的框架,通过均值场近似和softmax方法实现可扩展学习,并在能源市场仿真中验证其经济效率、公平性和稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00015 2026-06-02 cs.HC cs.AI cs.CY cs.ET 57%

SortingHat: Redefining Operating Systems Education with a Tailored Digital Teaching Assistant

SortingHat: 用定制的数字教学助手重新定义操作系统教育

Yifan Zhang, Xinkui Zhao, Zuxin Wang, Zhengyi Zhou, Guanjie Chen, Shuiguang Deng, Jianwei Yin

机构 * School of Software Technology, Zhejiang University(浙江大学软件学院)

专题命中 多智能体 :agent(abstract);分类 cs.AI

AI总结 针对操作系统课程教学挑战,提出结合检索增强生成和多智能体强化学习的3D数字人教学助手SortingHat,提供个性化指导、自适应内容生成和自动评估。

Journal ref WWW '25: Companion Proceedings of the ACM on Web Conference 2025,Pages 2951 - 2954

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01309 2026-06-02 cs.DS 50%

Multiagent Matroid Upgrading: Greedy is Fair and Efficient

多智能体拟阵升级:贪婪是公平且高效的

Qingwen Ma, Chao Peng, Changfeng Xu, Chenyang Xu, Ruilong Zhang

专题命中 多智能体 :agent(abstract)

AI总结 本文提出多智能体拟阵升级问题,通过贪婪算法在公平性和效率之间取得平衡,用于优化多智能体系统中的资源分配。

Comments Appeared in AAMAS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01191 2026-06-02 eess.SP 50%

Experimental Demonstration of a Real Time Wideband OFDM Generation in Sub-THz

亚THz频段实时宽带OFDM生成的实验演示

Eray Güven, Nesrine Benchoubane, Güneş Karabulut Kurt

专题命中 多智能体 :workflow(abstract)

AI总结 本文提出并实验验证了一种基于级联软件无线电的实时多射频通道OFDM传输平台,在180 GHz频段实现了约1.1 GHz瞬时带宽,并分析了相位噪声、频谱占用及滤波损耗等关键性能。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 工作流自动化 42 篇

2605.14830 2026-06-02 cs.HC 90%

Agentic AI and Human-in-the-Loop Interventions: Field Experimental Evidence from Alibaba's Customer Service Operations

Agentic AI与人在回路干预:来自阿里巴巴客服运营的现场实验证据

Yiwei Wang, Chuan Zhu, Tianjun Feng, Lauren Xiaoyuan Lu, Bingxin Jia

专题命中 工作流自动化 :agentic(title,title_cn);workflow(abstract)

AI总结 通过在阿里巴巴淘宝平台上的随机现场实验,研究Agentic AI在客服运营中失败时,人类干预如何影响服务结果,发现干预效果取决于AI失败类型、干预时机和努力程度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01416 2026-06-02 cs.AI 85%

Self-Healing Agentic Orchestrators for Reliable Tool-Augmented Large Language Model Systems

用于可靠的工具增强型大语言模型系统的自愈代理编排器

Rahul Suresh Babu, Adarsh Agrawal

机构 * Independent Researcher(独立研究者) Senior Member, IEEE(IEEE高级成员)

专题命中 工作流自动化 :agentic(title,abstract);planning(abstract);workflow(abstract);分类 cs.AI

AI总结 提出一种自愈代理编排器,通过将可靠性视为有界运行时控制问题,映射故障信号、选择恢复动作并验证轨迹,在100任务故障注入基准上达到98.8%任务成功率,优于重试和完全重规划基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00204 2026-06-02 cs.CV 85%

APE: Agentic Prompt Enhancer for Image Generation and Editing

APE: 用于图像生成与编辑的智能提示增强器

Zijian Huang, Jay Zhangjie Wu, Zian Wang, Tianshi Cao, Jiasi Chen, Sanja Fidler, Huan Ling, Xuanchi Ren

机构 * NVIDIA University of Michigan(密歇根大学)

专题命中 工作流自动化 :agentic(title,abstract);agent(abstract);multi-agent(abstract)

AI总结 提出APE框架,通过后训练小型语言模型作为提示增强代理,以单代理或多代理方式改进文本到图像生成与编辑中的提示质量,无需修改下游视觉模型。

Comments Project Page: https://research.nvidia.com/labs/sil/projects/ape/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00708 2026-06-02 cs.AI cs.LG 84%

MOSAIC: Modular Orchestration for Structured Agentic Intelligence and Composition

MOSAIC:结构化智能体智能与组合的模块化编排

Yifan Bao, Xinyu Xi, Xinyu Liu, Wen Ge, Lei Jiang, Kevin Zhang, Raad Khraishi, Yihao Ang, Anthony K. H. Tung, Lukasz Szpruch, Hao Ni

机构 * Department of Computer Science, National University of Singapore(新加坡国立大学计算机科学系) University College London(伦敦大学学院) University of Edinburgh(爱丁堡大学) Data & Analytics, Digital X(Digital X 数据与分析部) Alan Turing Institute(艾伦·图灵研究所)

专题命中 工作流自动化 :agentic(title,abstract);workflow(abstract);分类 cs.AI、cs.LG

AI总结 提出MOSAIC框架,通过结构化智能体编排、记忆驱动的模型选择和蓝图构建,将自动化数据科学转化为可验证、可复用的模型选择问题,在金融时间序列任务中优于AutoML和智能体基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00370 2026-06-02 cs.HC cs.AI 83%

Agentic Authoring of Interactive Multiview Visualizations in Genomics

交互式多视图基因组学可视化的智能体创作

Astrid van den Brandt, Kiroong Choe, Sehi L'Yi, Devin Lange, Nils Gehlenborg

机构 * Harvard Medical School(哈佛医学院) Boston College(波士顿学院)

专题命中 工作流自动化 :agentic(title,abstract);agent(abstract);分类 cs.AI

AI总结 针对基因组学可视化创作中定制化不足和编程门槛高的问题,提出基于大语言模型的智能体方案,通过结构化输出和迭代优化提升可视化质量。

Comments 11 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01109 2026-06-02 cs.DL cs.CL 79%

Digging Up Citations: FOSSIL, a Dataset and Workflow for Reference Extraction in Law and the Humanities

挖掘引文:FOSSIL——法律与人文学科参考文献提取的数据集与工作流

Luca Foppiano, Christian Boulanger

机构 * University of Amsterdam(阿姆斯特丹大学)

专题命中 工作流自动化 :workflow(title,abstract);分类 cs.CL

AI总结 针对法律和人文学科脚注中参考文献提取的挑战,本文提出FOSSIL数据集、PDF-TEI编辑器、标注工作流和Grobid特化模块,将提取质量从0.36提升至0.72(micro-F1)。

Comments This is an extended abstract, peer-reviewed and presented at CiteX2026 https://sites.google.com/view/workshop-on-citation-extractio/startseite

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18043 2026-06-02 cs.CR cs.AI cs.CY 79%

Securing Agentic AI Systems -- A Multilayer Security Framework

保护自主AI系统——一种多层安全框架

Sunil Arora, John Hastings

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 工作流自动化 :agentic(title,abstract);分类 cs.AI

AI总结 针对自主AI系统的独特安全挑战,本文采用设计科学研究方法,提出了一种生命周期感知的安全框架MAAIS,并引入自主AI的CIAA概念,通过多层防御机制确保AI生命周期的机密性、完整性、可用性和问责性,最后利用MITRE ATLAS进行验证。

Comments 6 pages, 2 figures, 1 table

Journal ref 2025 IEEE 5th International Conference on Robotics, Automation, and Artificial Intelligence (RAAI)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02021 2026-06-02 cs.CV 78%

PerBite: A Curated Diagnostic Workflow for Bite-Aware Food Volume Estimation

PerBite: 一种用于咬合感知食物体积估计的精选诊断工作流

Ahmad AlMughrabi, Farid Al-Areqi, David Fernández Gómez, Umair Haroon, Marc Bolaños, Ricardo Marques, Petia Radeva

机构 * University of Barcelona(巴塞罗那大学) LogMeal Universitat Pompeu Fabra(庞培法布拉大学)

专题命中 工作流自动化 :workflow(title,abstract)

AI总结 提出PerBite工作流,通过分割、三维重建、尺度校准和网格后处理等步骤,从餐前餐后状态估计食物体积,在MetaFood挑战中排名第一。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01642 2026-06-02 q-bio.SC 78%

An agent-based model of outer membrane biogenesis in Gram-negative bacteria

革兰氏阴性菌外膜生物发生的基于智能体的模型

Thomas Williams, James M. Osborne, Kwok Jian Goh, Trevor Lithgow, Jennifer Flegg

专题命中 工作流自动化 :agent(title,abstract)

AI总结 通过半定量基于智能体模型,研究革兰氏阴性菌外膜生长过程中的分子尺度动力学,发现BAM复合体介导的蛋白插入易停滞且呈爆发式,并暗示BAM与Lpt复合体协同工作。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01428 2026-06-02 stat.ME stat.AP 78%

Quantifying Evidential Rigor in Meta-Analytic Corpora: A Simulation-Characterized, Bias-Robust Bayesian Workflow with a Nutrition Case Study

量化元分析语料库中的证据严谨性:一个模拟表征、偏差稳健的贝叶斯工作流及营养学案例研究

Matt Hester

专题命中 工作流自动化 :workflow(title,abstract)

AI总结 提出一个语料库规模的贝叶斯证据审计工作流,通过联合贝叶斯因子综合效应/无效应证据和偏差成分缺失来量化证据严谨性,并使用ADEMP框架的模拟/重采样设计进行表征,以营养干预语料库作为案例研究。

Comments 59 pages, 13 figures; supplementary material included as ancillary file; companion repository archived at Zenodo, DOI: 10.5281/zenodo.20467258

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01203 2026-06-02 cs.HC 78%

From Craft Practice to Aesthetic Cognition Transmission: Workflow Cognition Translation for AI-native Intangible Cultural Heritage Education

从工艺实践到审美认知传递:面向AI原生的非物质文化遗产教育工作流认知翻译

Annie Yuan

专题命中 工作流自动化 :workflow(title,abstract)

AI总结 本文提出工作流认知翻译方法,将专家审美认知转化为可计算的教育表示,以支持AI原生的非物质文化遗产教育,实现审美认知的可扩展传递。

Comments 22 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00348 2026-06-02 cs.DC 78%

Augur: Pre-Execution Energy Prediction for Workflow Tasks in Heterogeneous Clusters

Augur: 异构集群中工作流任务的执行前能耗预测

Kathleen West, Vasilis Bountris, Philipp Thamm, Ulf Leser, Yehia Elkhatib, Lauritz Thamsen

专题命中 工作流自动化 :workflow(title,abstract)

AI总结 提出Augur方法,通过高效分析集群基础设施和工作流特征,在任务执行前预测能耗,中位预测误差约16-18%,优于现有方法。

Comments Accepted at 2026 IEEE International Conference on Cloud Computing (CLOUD)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04672 2026-06-02 cs.CV cs.GR cs.RO 78%

AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation

AGILE: 通过代理生成从视频重建手-物体交互

Jin-Chuan Shi, Binhong Ye, Tao Liu, Junzhe He, Yangjinhui Xu, Xiaoyang Liu, Zeju Li, Hao Chen, Chunhua Shen

机构 * State Key Lab of CAD & CG, Zhejiang University(浙江大学计算机辅助设计与图形学国家重点实验室) Zhejiang University of Technology(浙江工业大学)

专题命中 工作流自动化 :agentic(title,abstract)

AI总结 提出AGILE框架,利用视觉语言模型引导生成完整物体网格,结合锚定-跟踪策略和接触感知优化,从单目视频鲁棒重建手-物体交互,生成可直接用于仿真的资产。

Comments 16 pages, SIGGRAPH 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16733 2026-06-02 econ.EM stat.ME 78%

Scaling Reproducibility: An AI-Assisted Workflow for Large-Scale Replication and Reanalysis

规模化可重复性:一种用于大规模复制与再分析的人工智能辅助工作流

Yiqing Xu, Leo Yang Yang

专题命中 工作流自动化 :workflow(title,abstract)

AI总结 提出一种AI辅助工作流,实现论文全自动复制,并应用于政治学顶级期刊的384篇论文,发现期刊验证要求与数据存档政策显著提升可重复性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28765 2026-06-02 physics.optics 71%

A variability-aware simulation and design workflow for wafer-scale, heterogeneously integrated lithium niobate modulators

面向晶圆级异质集成铌酸锂调制器的变异性感知仿真与设计流程

Patrick Nenezic, Ewoud Vissers, Arno Moerman, Laurens Bogaert, Maximilien Billet, Xiujun Zheng, Tom Vanackere, Margot Niels, Athina Papadopoulou, Sarah Uvin, Peter De Heyn, Sandeep Saseendran, Simone Atzeni, Bart Kuyken

专题命中 工作流自动化 :workflow(title)

AI总结 提出一种考虑制造变异性的仿真框架,通过多参数优化方法实现铌酸锂调制器在晶圆级制造中的稳健性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02540 2026-06-02 cs.CL 70%

SkillHarm: Lifecycle-Aware Skill-Based Attacks via Automated Construction

SkillHarm: 通过自动化构建实现生命周期感知的基于技能的攻

Yuting Ning, Zhehao Zhang, Yash Kumar Lal, Boyu Gou, Junyi Li, Weitong Ruan, Chentao Ye, Rahul Gupta, Diyi Yang, Yu Su, Huan Sun

机构 * The Ohio State University(俄亥俄州立大学) Amazon AGI(亚马逊人工智能实验室) Stanford University(斯坦福大学)

专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.CL

AI总结 提出SkillHarm基准,通过固定载荷投毒和自我变异投毒两种攻击场景,系统评估基于技能的攻击在技能使用生命周期中的风险,并构建自动化管道AutoSkillHarm生成大规模攻击样本。

Comments Work in Progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15278 2026-06-02 cs.CV cs.AI 70%

Visual Persuasion: What Influences Decisions of Vision-Language Models?

视觉说服:什么影响了视觉语言模型的决策?

Manuel Cherep, Pranav M R, Pattie Maes, Nikhil Singh

机构 * Massachusetts Institute of Technology(麻省理工学院) MIT Media Lab(MIT媒体实验室)

专题命中 工作流自动化 :agent(abstract);AI agent(abstract);分类 cs.AI

AI总结 提出一个框架,通过控制图像选择任务并系统性地扰动输入,利用视觉提示优化方法推断视觉语言模型的潜在视觉效用,揭示影响模型决策的视觉偏好。

Comments Accepted to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏