arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-04-09 至 2026-04-09 共收录 118 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 多智能体 19 篇

2604.07204 2026-04-09 cs.MA 67%

Designing for Accountable Agents: a Viewpoint

为可问责的智能体设计:一种观点

Stephen Cranefield, Nir Oren

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文探讨了多智能体系统中智能体的可问责性,提出了一种定义并分析其在开放社会技术系统中的应用,识别了研究挑战和未来研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04691 2026-04-09 cs.RO cs.AI cs.MA 57%

Before Humans Join the Team: Diagnosing Coordination Failures in Healthcare Robot Team Simulation

在人类加入团队之前:医疗机器人团队模拟中的协调失败诊断

Yuanchen Bai, Zijian Ding, Shaoyue Wen, Xiang Chang, Angelique Taylor

机构 * Cornell Tech(康奈尔科技校区) Department of Information Science, Cornell University(康奈尔大学信息科学系) University of Maryland, College Park(马里兰大学帕克分校) Imperial College London(伦敦帝国学院)

专题命中 多智能体 :agent(abstract);分类 cs.AI

AI总结 本文通过模拟方法研究医疗机器人团队的协调失败问题,发现团队结构是协调的主要瓶颈,并提出安全的人机协作设计方法。

Comments Revised version incorporating new analysis and restructuring

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.19420 2026-04-09 cs.AI 57%

Commander-GPT: Dividing and Routing for Multimodal Sarcasm Detection

Commander-GPT:多模态讽刺检测的分工与路由

Yazhou Zhang, Chunwang Zou, Bo Wang, Jing Qin, Prayag Tiwari

专题命中 多智能体 :agent(abstract);分类 cs.AI

AI总结 本文提出Commander-GPT框架,通过分工协作的LLM代理团队,结合三种指挥官类型,提升多模态讽刺检测性能,实验结果显示在F1分数上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06813 2026-04-09 cs.MA 50%

Event-Triggered Adaptive Consensus for Multi-Robot Task Allocation

基于事件触发的多机器人任务分配自适应一致性

Fidel Aznar, Mar Pujol, Álvaro Díez

专题命中 多智能体 :agent(abstract)

AI总结 本文提出一种基于事件触发的自适应一致性框架,用于在动态和通信受限环境中实现高效适应性任务分配。通过自适应一致性机制和行为树架构,减少通信开销并提升系统效率和鲁棒性。

Comments 40 pages, 18 figures. Published in Computer Communications under CC-BY license

Journal ref Computer Communications, Volume 251, 2026, 108499

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 工作流自动化 13 篇

2604.06392 2026-04-09 cs.AI cs.MA cs.SE 91%

Qualixar OS: A Universal Operating System for AI Agent Orchestration

Qualixar OS:面向AI代理编排的通用操作系统

Varun Pratap Bhardwaj

专题命中 工作流自动化 :agent(title,abstract);AI agent(title,abstract);workflow(abstract);multi-agent(abstract)

AI总结 Qualixar OS是首个应用层操作系统,支持异构多代理系统,提供10个LLM供应商、8+代理框架和7种传输的完整运行时,包含12种多代理拓扑执行语义、LLM驱动的团队设计引擎、三层模型路由、共识判断管道、四层内容归属和通用兼容性等功能。

Comments 20 pages, 7 figures, 8 tables. Zenodo DOI: 10.5281/zenodo.19454219

URL PDF HTML 收藏
2604.06554 2026-04-09 eess.SY cs.SY 67%

Decentralized Scalar Field Mapping using Gaussian Process

基于高斯过程的去中心化标量场映射

Hossein Papi, Muzaffar Qureshi, Kyle Volle, Rushikesh Kamalapurkar

专题命中 工作流自动化 :agent(abstract);multi-agent(abstract)

AI总结 本文提出去中心化交集数据共享与同化协议,通过局部高斯过程模型和子域重叠几何构造邻居特定包,提升团队预测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06523 2026-04-09 quant-ph cs.AI cs.LG 62%

Soft-Quantum Algorithms

软量子算法

Basil Kyriacou, Mo Kordzanganeh, Maniraman Periyasamy, Alexey Melnikov

机构 * Terra Quantum AG

专题命中 工作流自动化 :agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出通过单个正则化项训练保持单位性的矩阵,再通过电路对齐恢复门基架构,从而提升量子机器学习效率。

Comments 6 pages, 6 figures, 0 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06358 2026-04-09 cs.GR cs.AI 57%

GS-Surrogate: Deformable Gaussian Splatting for Parameter Space Exploration of Ensemble Simulations

GS-Surrogate:基于可变形高斯散点的参数空间探索的可变形高斯散点

Ziwei Li, Rumali Perera, Angus Forbes, Ken Moreland, Dave Pugmire, Scott Klasky, Wei-Lun Chao, Han-Wei Shen

机构 * The Ohio State University(俄亥俄州立大学) NVIDIA(英伟达) Oak Ridge National Laboratory(橡树岭国家实验室)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 本文提出GS-Surrogate,一种基于可变形高斯散点的可视化替代模型,用于参数空间探索。通过构建标准高斯场并进行参数条件变形,实现高效可控的可视化任务适应,如等值面提取和转移函数编辑。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06274 2026-04-09 cs.CR cs.AI 57%

Towards the Development of an LLM-Based Methodology for Automated Security Profiling in Compliance with Ukrainian Cybersecurity Regulations

迈向基于大语言模型的自动化安全配置方法的开发:符合乌克兰网络安全法规

Daniil Shafranskyi, Iryna Stopochkina, Mykola Ilin

机构 * National Technical University of Ukraine “Igor Sikorsky Kyiv Polytechnic Institute”(乌克兰国立技术大学“伊戈尔·西科尔斯基基辅理工学院”)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 本文探讨将国际最佳实践整合到国家监管体系中,提出利用大语言模型实现自动化安全配置的方法,以应对高密度混合威胁环境下的网络安全挑战。

Comments 12 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06878 2026-04-09 cs.PL cs.LO 50%

Towards Multiparty Session Types for Highly-Concurrent and Fault-Tolerant Web Applications

面向高并发和容错Web应用的多方会话类型

Richard Casetta, Nils Gesbert, Pierre Genevès

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出一种全局类型框架,为多方会话类型添加显式失败语义和动态参与,以支持高并发和容错Web应用的正式验证。

Comments In Proceedings PLACES 2026, arXiv:2604.05737

Journal ref EPTCS 444, 2026, pp. 68-78

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06671 2026-04-09 eess.IV cs.CV physics.med-ph 50%

4D Vessel Reconstruction for Benchtop Thrombectomy Analysis

用于台式血栓切除分析的4D血管重建

Ethan Nguyen, Javier Carmona, Arisa Matsuzaki, Naoki Kaneko, Katsushi Arisaka

机构 * UCLA Health(加州大学洛杉矶分校健康中心) UCLA Physics and Astronomy(加州大学洛杉矶分校物理与天文学系) Chan Zuckerberg Biohub Network(陈-扎克伯格生物中心网络) Ronald Reagan UCLA Medical Center(罗纳德·里根加州大学洛杉矶分校医学中心)

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出了一种低成本多视角工作流,用于台式血栓切除的4D高斯点云重建,实现了时间分辨的表面运动学和相对位移及应力代理测量,用于血栓切除台式研究。

Comments 20 pages, 10 figures, 1 table, supplementary material (3 tables, 3 figures, and 11 videos). Project page: https://ethanuser.github.io/vessel4D/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06489 2026-04-09 cs.HC cs.MM 50%

Language-Guided Multimodal Texture Authoring via Generative Models

基于生成模型的语言引导多模态纹理创作

Wanli Qian, Aiden Chang, Shihan Lu, Michael Gu, Heather Culbertson

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出一种语言驱动的多模态纹理创作系统,通过生成模型将自然语言提示转化为触觉和视觉纹理,实现触觉与视觉信号的语义一致性,提升创作效率与可解释性。

Comments 14 pages, 13 figures, accepted to IEEE Haptics Symposium 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06408 2026-04-09 cs.NI 50%

Towards Realistic Waveform-Level IoT Network Simulation via IQ Mixing

通过I-Q混频实现真实波形级物联网网络仿真

Alexis Delplace, Samer Lahoud, Kinda Khawam, Dominique Quadri

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出IQSim仿真方法,通过I-Q流混频模拟真实波形,解决传统包级仿真在邻道泄漏、交叉调制等关键波形效应上的不足,支持异构Sub-GHz ISM频段共存场景的仿真。

Comments Accepted for publication at the 2026 IEEE International Symposium on Spectrum Innovation (DySPAN 2026). 5 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02576 2026-04-09 physics.comp-ph cond-mat.mtrl-sci 50%

Meta-optimization of maximally-localized Wannier functions

最大化局部化的沃因纳函数的元优化

Sabyasachi Tiwari, Bruno Cucco, Viet-Anh Ha, Feliciano Giustino

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出一种元优化方法,利用工作流抽象和机器学习技术,实现无需人工干预的全局优化沃因纳函数,应用于纠缠能带结构插值、加速玻尔兹曼输运计算和高精度沃因纳函数计算。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14776 2026-04-09 cs.HC 50%

Script2Screen: Supporting Dialogue Scriptwriting with Interactive Audiovisual Generation

Script2Screen: 通过交互式视听生成支持对话脚本写作

Zhecheng Wang, Jiaju Ma, Eitan Grinspun, Tovi Grossman, Bryan Wang

专题命中 工作流自动化 :workflow(abstract)

AI总结 Script2Screen通过整合脚本写作与视听场景创建,提供统一同步的工作流程,帮助作家通过交互式视听生成提升对话脚本创作效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07144 2026-04-09 cs.DC 50%

Autopoiesis: A Self-Evolving System Paradigm for LLM Serving Under Runtime Dynamics

自组织:一种面向LLM服务的自演化系统范式,用于运行时动态

Youhe Jiang, Ran Yan, You Peng, Wenshuang Li, Taiyi Wang, Fangcheng Fu, Binhang Yuan

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出Autopoiesis,一种自演化系统,使LLM服务从静态策略部署转向持续在线策略演化,通过实时动态驱动策略合成,提升服务在运行时动态下的适应性与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.17346 2026-04-09 cs.GR 50%

Preserving Discrete Morse-Smale Complexes in Error-Bounded Lossy Compression

在误差受限的损失性压缩中保持离散的莫尔斯-塞曼复形

Yuxiao Li, Mingze Xia, Xin Liang, Bei Wang, Hanqi Guo

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出了一种在损失性压缩中完整保持拓扑结构(特别是莫尔斯-塞曼复形)的方法,通过迭代编辑策略修正解压输出中的关键点和分离线,确保拓扑特征的准确保留。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 软件智能体 11 篇

2604.06284 2026-04-09 cs.CR cs.AI 83%

ClawLess: A Security Model of AI Agents

ClawLess:AI代理的安全模型

Hongyi Lu, Nian Liu, Shuai Wang, Fengwei Zhang

机构 * Department of Computer Science and Engineering, Southern University of Science and Technology(南方科技大学计算机科学与工程系) Department of Computer Science and Engineering, Hong Kong University of Science and Technology(香港科技大学计算机科学与工程系) Southern University of Science and Technology(南方科技大学) Hong Kong University of Science and Technology(香港科技大学)

专题命中 软件智能体 :AI agent(title,abstract);agent(abstract);分类 cs.AI

AI总结 ClawLess提出一种形式化安全框架,通过在最坏情况威胁模型下强制验证策略,确保AI代理运行时的安全性,结合BPF技术实现动态策略的高效执行。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03926 2026-04-09 cs.AI cs.CY cs.HC cs.MA 83%

CODE-GEN: A Human-in-the-Loop RAG-Based Agentic AI System for Multiple-Choice Question Generation

CODE-GEN:一种基于检索增强生成的多选题生成人机协作人工智能系统

Xiaojing Duan, Frederick Nwanganga, Chaoli Wang

机构 * University of Notre Dame(圣母大学)

专题命中 软件智能体 :agentic(title,abstract);agent(abstract);分类 cs.AI

AI总结 CODE-GEN通过生成与课程目标一致的多选题提升学生代码推理能力,采用生成器和验证器代理,结合专用工具提高准确性,评估结果显示系统在七个教学维度上表现优异,但人类专家仍需参与设计教学性干扰项和反馈质量。

Comments Full version of the paper accepted as a short paper at the 27th International Conference on Artificial Intelligence in Education (AIED 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16206 2026-04-09 cs.CL cs.AI 81%

Computer Environments Elicit General Agentic Intelligence in LLMs

计算机环境在大语言模型中激发通用代理智能

Daixuan Cheng, Shaohan Huang, Yuxian Gu, Huatong Song, Guoxin Chen, Li Dong, Wayne Xin Zhao, Ji-Rong Wen, Furu Wei

机构 * GSAI, Renmin University of China(中国人民大学高瓴人工智能学院) Microsoft Research(微软研究院) Tsinghua University(清华大学)

专题命中 软件智能体 :agentic(title,abstract);分类 cs.AI、cs.CL

AI总结 本文研究了计算机环境如何通过虚拟沙盒激发大语言模型的通用能力,展示了环境对任务解决的提升效果及训练方法。

Comments Project Page: https://llm-in-sandbox.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06241 2026-04-09 cs.CR 78%

ZitPit: Consumer-Side Admission Control for Agentic Software Intake

ZitPit:面向代理软件摄入的消费者侧准入控制

Jepson Taylor, Chris Brousseau, Jordan Hildebrandt, Kelli Quinn

专题命中 软件智能体 :agentic(title,abstract)

AI总结 ZitPit通过严格边界控制,确保首次见到的外部工件成为持久政策事件,统一了工件准入、仓库开放状态、能力范围执行和持久政策记录,提升代理工作流的安全性。

Comments 6 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03460 2026-04-09 physics.chem-ph physics.comp-ph 78%

FermiLink: A Unified Agent Framework for Multidomain Autonomous Scientific Simulations

FermiLink:一个多领域自主科学模拟的统一代理框架

Gang Meng, Andres Felipe Bocanegra Vargas, Xinwei Ji, Federico Garcia-Gaitan, Felipe Reyes-Osorio, Jalil Varela-Manjarres, Yafei Ren, Mohammadhasan Dinpajooh, Branislav K. Nikolić, Tao E. Li

专题命中 软件智能体 :agent(title,abstract)

AI总结 FermiLink通过分离知识库与模拟工作流,实现多领域科学模拟的统一框架,能高效复现74%的科学图表并生成高质量研究成果。

Comments Simulation data available at https://www.taoeli.org/publications; source code available at Github https://github.com/TaoELi/FermiLink

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18341 2026-04-09 cs.SE 74%

Agentic Much? Adoption of Coding Agents on GitHub

代理那么多?GitHub上编码代理的采用情况

Romain Robbes, Théo Matricon, Thomas Degueule, Andre Hora, Stefano Zacchiroli

专题命中 软件智能体 :agentic(title);分类 cs.SE

AI总结 研究探讨了编码代理在GitHub上的采用情况,发现其采用率高达22.20%-28.66%,且在项目成熟度、组织类型和编程语言上均广泛适用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06793 2026-04-09 cs.SE cs.AI 62%

Evaluating Repository-level Software Documentation via Question Answering and Feature-Driven Development

通过问答和基于特征的开发评估仓库级软件文档

Xinchen Wang, Ruida Hu, Cuiyun Gao, Pengfei Gao, Chao Peng

机构 * Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学(深圳)) Independent Researcher, China(独立研究者)

专题命中 软件智能体 :agent(abstract);分类 cs.AI、cs.SE

AI总结 本文提出SWD-Bench基准,通过功能驱动的问答任务评估仓库级文档质量,揭示现有方法局限,并展示高质量文档对SWE-Agent问题解决率的提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06603 2026-04-09 cs.CL cs.AI 62%

Scientific Knowledge-driven Decoding Constraints Improving the Reliability of LLMs

基于科学知识的解码约束:提升大语言模型的可靠性

Maotian Ma, Zheni Zeng, Zhenghao Liu, Yukun Yan

机构 * Nanjing University(南京大学) Tsinghua University(清华大学) Northeastern University(东北大学)

专题命中 软件智能体 :planning(abstract);分类 cs.AI、cs.CL

AI总结 本文提出SciDC方法,通过整合领域知识与强约束提升LLM在科学任务中的可靠性,实验显示在工业配方设计、肿瘤诊断和逆合成规划中平均准确率提升12%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06373 2026-04-09 cs.SE cs.AI 62%

Beyond Functional Correctness: Design Issues in AI IDE-Generated Large-Scale Projects

超越功能性正确性:AI IDE生成大规模项目的 设计问题

Syed Mohammad Kashif, Ruiyin Li, Peng Liang, Amjed Tahir, Qiong Feng, Zengyang Li, Mojtaba Shahin

机构 * School of Computer Science, Wuhan University(武汉大学计算机学院) School of Mathematical and Computational Sciences, Massey University(梅西大学数学与计算科学学院) School of Computer Science, Nanjing University of Science and Technology(南京理工大学计算机科学与工程学院) School of Computer Science, Central China Normal University(华中师范大学计算机学院) School of Computing Technologies, RMIT University(RMIT大学计算技术学院)

专题命中 软件智能体 :agentic(abstract);分类 cs.AI、cs.SE

AI总结 本文研究了AI IDE生成大规模项目的功能正确性和设计问题,通过FD-HITL框架生成10个项目,发现存在大量设计缺陷,需专业开发者审查。

Comments 40 pages, 19 images, 5 tables, Manuscript submitted to a Journal (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07304 2026-04-09 cs.SE cs.AI 62%

Chatbot-Based Assessment of Code Understanding in Automated Programming Assessment Systems

基于聊天机器人的代码理解评估在自动化编程评估系统中的应用

Eduard Frankford, Erik Cikalleshi, Ruth Breu

机构 * University of Innsbruck(因斯布鲁克大学)

专题命中 软件智能体 :agent(abstract);分类 cs.AI、cs.SE

AI总结 本文探讨了聊天机器人在自动化编程评估中的应用,提出混合苏格拉底框架以整合对话验证,解决代码理解评估中的挑战。

Comments 12 pages, accepted for publication at CSEDU 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06861 2026-04-09 cs.SE 57%

REAgent: Requirement-Driven LLM Agents for Software Issue Resolution

REAgent:基于需求的LLM代理用于软件问题解决

Shiqi Kuang, Zhao Tian, Kaiwei Lin, Chaofan Tao, Shaowei Wang, Haoli Bai, Lifeng Shang, Junjie Chen

专题命中 软件智能体 :agent(abstract);分类 cs.SE

AI总结 本文提出REAgent框架,通过引入问题导向的需求作为结构化任务规范,提升补丁生成准确性,实验表明其在问题解决率上平均提升17.40%。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. GUI与网页智能体 9 篇

2604.06177 2026-04-09 cs.IR cs.AI cs.CL 73%

WebExpert: domain-aware web agents with critic-guided expert experience for high-precision search

WebExpert: 基于领域感知的网页代理:通过批评者引导的专家经验实现高精度搜索

Yuelin Hu, Zhengxue Cheng, Ronghua Wu, Qunshan Gu, Hongwei Hu, Wei Liu, Qiao Liang, Li Song

专题命中 GUI与网页智能体 :agent(abstract);planning(abstract);分类 cs.AI、cs.CL

AI总结 WebExpert通过领域感知的网页代理,结合批评者引导的专家经验,提升搜索精度,其核心方法包括句子级经验检索、结构化轻量级领域诱导及偏好优化规划,有效提升了答案准确率。

Comments accepted by icassp2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.22025 2026-04-09 cs.AI cs.CL cs.CV 73%

UI-AGILE: Advancing GUI Agents with Effective Reinforcement Learning and Precise Inference-Time Grounding

UI-AGILE: 通过有效的强化学习和精确的推理时间接地提升GUI代理

Shuquan Lian, Yuhang Wu, Jia Ma, Yifan Ding, Zihan Song, Bingqi Chen, Xiawu Zheng, Hui Li, Rongrong Ji

机构 * Sino-Russian Research Center for Digital Economy(中俄数字经济研究中心)

专题命中 GUI与网页智能体 :agent(abstract);planning(abstract);分类 cs.AI、cs.CL

AI总结 UI-AGILE通过改进监督微调过程和推理中的分解接地,提升了GUI代理的接地性能和通用能力,在ScreenSpot-Pro和ScreenSpot-v2基准上实现了最佳表现,地面准确率提升23%。

详情

展开后加载摘要…

URL PDF HTML 收藏