arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-03-27 至 2026-03-27 共收录 104 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工作流自动化 12 篇

2603.25243 2026-03-27 cs.AR cs.AI 85%

FluxEDA: A Unified Execution Infrastructure for Stateful Agentic EDA

FluxEDA: 一种用于状态性代理EDA的统一执行基础设施

Zhengrui Chen, Zixuan Song, Yu Li, Qi Sun, Cheng Zhuo

机构 * Zhejiang University(浙江大学)

专题命中 工作流自动化 :agentic(title,abstract);agent(abstract);autonomous agent(abstract);分类 cs.AI

AI总结 本文提出FluxEDA,一种统一的状态性代理EDA基础设施,通过结构化请求响应和持久后端实例支持工具状态保留,实现异构EDA工具的多步分析与优化。

Comments qisunchn@zju.edu.cn, czhuo@zju.edu.cn

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25063 2026-03-27 cs.HC cs.AI cs.GR cs.LG 84%

TopoPilot: Reliable Conversational Workflow Automation for Topological Data Analysis and Visualization

TopoPilot:拓扑数据分析和可视化可靠对话工作流自动化

Nathaniel Gorski, Shusen Liu, Bei Wang

机构 * University of Utah(犹他大学) Lawrence Livermore National Laboratory(劳伦斯利弗莫尔国家实验室)

专题命中 工作流自动化 :workflow(title);agent(abstract);agentic(abstract);分类 cs.AI、cs.LG

AI总结 TopoPilot通过双代理架构和系统性防护机制,实现复杂科学可视化工作流的可靠自动化,其在1000次多轮对话中成功率达99%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25738 2026-03-27 cs.CV 82%

PSDesigner: Automated Graphic Design with a Human-Like Creative Workflow

PSDesigner: 基于人类创意流程的自动化图形设计

Xincheng Shuai, Song Tang, Yutong Huang, Henghui Ding, Dacheng Tao

机构 * Institute of Big Data, College of Computer Science and Artificial Intelligence, Fudan University(复旦大学计算机科学与技术学院大数据研究所) Generative AI Lab, College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院生成式人工智能实验室)

专题命中 工作流自动化 :workflow(title,abstract);tool-use(abstract)

AI总结 PSDesigner通过模拟人类设计师的创意流程,实现了自动化图形设计,通过设计数据集CreativePSD提升工具使用能力,在多种设计任务中优于现有方法,使非专业人士能轻松创建高质量设计。

Comments CVPR 2026, Project Page: https://henghuiding.com/PSDesigner/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25636 2026-03-27 cs.CV 78%

Designing Any Imaging System from Natural Language: Agent-Constrained Composition over a Finite Primitive Basis

从自然语言设计成像系统:在有限基本元素基础上的代理约束组成

Chengshuai Yang

机构 * NextGen PlatformAI C Corp, USA(美国NextGen PlatformAI C公司)

专题命中 工作流自动化 :agent(title);autonomous agent(abstract)

AI总结 本文提出spec.md格式和三个自主代理,将自然语言描述转化为验证的正向模型,减少成像系统设计的专家瓶颈,实现多模态的自动化设计。

Comments 28 pages, 7 figures, 8 tables, includes Supplementary Information (sections S1-S6)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13854 2026-03-27 cs.CY cs.AI 77%

Understanding the Process of Human-AI Value Alignment

理解人机价值对齐的过程

Jack McKinlay, Marina De Vos, Janina A. Hoffmann, Andreas Theodorou

机构 * University of Bath(巴斯大学)

专题命中 工作流自动化 :agent(abstract);AI agent(abstract);autonomous agent(abstract);分类 cs.AI

AI总结 本文通过系统文献综述,探讨人工智能中价值对齐的核心方法与挑战,提出更精确的定义,识别六个关键主题以指导未来研究。

Comments 39 pages, 7 figures

Journal ref JAIR, Vol 85, Article 29 (March 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24402 2026-03-27 cs.AI 70%

AI-Supervisor: Autonomous AI Research Supervision via a Persistent Research World Model

AI-Supervisor: 通过持续的研究世界模型实现自主的AI研究监督

Yunbo Long

专题命中 工作流自动化 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文提出AI-Supervisor框架,通过持续演进的知识图谱实现自主探索和自我修正的研究监督,解决传统线性流程无法处理研究空白和验证问题的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25495 2026-03-27 cs.LG cs.AI 62%

Interpretable PM2.5 Forecasting for Urban Air Quality: A Comparative Study of Operational Time-Series Models

可解释的PM2.5预报用于城市空气质量:操作时间序列模型的比较研究

Moazzam Umer Gondal, Hamad ul Qudous, Asma Ahmad Farhan, Sultan Alamri

机构 * School of Computing, National University of Computer & Emerging Sciences (FAST)(国家计算机与新兴科学大学(FAST)计算学院) College of Computing and Informatics, Saudi Electronic University(沙特电子大学计算与信息学院)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI、cs.LG

AI总结 本文比较了三种模型在预测北京小时PM2.5中的性能,发现Facebook Prophet在走动重拟合下表现最佳,且计算效率高,修正后误差更低。

Comments Submitted to PLOS ONE

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25357 2026-03-27 cs.CV 50%

InstanceAnimator: Multi-Instance Sketch Video Colorization

Yinhan Zhang, Yue Ma, Bingyuan Wang, Kunyu Feng, Yeying Jin, Qifeng Chen, Anyi Rao, Zeyu Wang

机构 * HKUST(GZ)(香港科技大学(广州)) HKUST(香港科技大学) NUS(新加坡国立大学)

专题命中 工作流自动化 :workflow(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08013 2026-03-27 q-bio.QM 50%

Mathematical Discovery of Potential Therapeutic Targets: Application to Rare Melanomas

数学发现潜在治疗靶点:应用于罕见黑色素瘤

Mahya Aghaee, Victoria Cicchirillo, Rowan Milner, Kyle Adams, Julia Bruner, William Hager, Ashley N. Brown, Elias Sayour, Domenico Santoro, Bently Doonan, Helen Moore

专题命中 工作流自动化 :workflow(abstract)

AI总结 本研究通过建立数学模型揭示罕见黑色素瘤的肿瘤-免疫动态,为开发新疗法和提高现有治疗响应率提供潜在靶点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.03445 2026-03-27 q-fin.MF math.PR 50%

A stochastic volatility approximation for a tick-by-tick price model with mean-field interaction

对具有均场相互作用的逐tick价格模型的随机波动率近似

Paolo Dai Pra, Paolo Pigato

专题命中 工作流自动化 :agent(abstract)

AI总结 本文研究了一个基于自激发点过程的逐tick价格模型,通过均场相互作用聚合大量订单过程,发现当参数达到临界值时,波动率过程表现出超线性均值回归和杠杆效应。

Comments 31 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24924 2026-03-27 physics.chem-ph 50%

A sustainable photocatalytic pathway for concurrent hydrogen and value-added chemical production utilizing microalgae as bio-scavenger in water

一种可持续的光催化路径,用于同时生产氢气和高附加值化学品,利用微藻作为水中的生物 scavenger

Ho Truong Nam Hai, Augusto Ducati Luchessi, Kaveh Edalati

专题命中 工作流自动化 :agent(abstract)

AI总结 本文提出利用微藻作为牺牲剂与传统光催化水裂解过程结合,提高绿色氢气生产并转化为甲烷和一氧化碳等高附加值化学品。

Journal ref International Journal of Hydrogen Energy, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24822 2026-03-27 quant-ph 50%

Coefficient-Decoupled Matrix Product Operators as an Interface to Linear-Combination-of-Unitaries Circuits

系数解耦的矩阵积运算符作为线性组合的单元电路接口

Younes Javanmard

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出一种系数解耦的MPO表示法,用于Pauli求和运算符,提供直接接口到线性组合的单元电路,通过静态Select oracle和动态Prep oracle实现可重用的编译策略。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 软件智能体 8 篇

2506.02943 2026-03-27 cs.SE 84%

Hallucination to Consensus: Multi-Agent LLMs for End-to-End JUnit Test Generation

幻觉到共识:多智能体LLM用于端到端JUnit测试生成

Qinghua Xu, Guancheng Wang, Lionel Briand, Kui Liu

专题命中 软件智能体 :agent(title);multi-agent(title);分类 cs.SE

AI总结 本文提出CANDOR框架,通过多智能体协作生成Java单元测试,利用共识策略减少幻觉并提升Oracle准确性,实验表明其在代码覆盖率和突变得分上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24736 2026-03-27 cs.AI cs.LG 84%

AutoSAM: an Agentic Framework for Automating Input File Generation for the SAM Code with Multi-Modal Retrieval-Augmented Generation

AutoSAM:一种用于自动化生成SAM代码输入文件的代理框架,结合多模态检索增强生成

Zaid Abulawi, Zavier Ndum Ndum, Eric Cervi, Rui Hu, Yang Liu

机构 * Department of Nuclear Engineering, Texas A\&M University. Engineering Division, Argonne National Laboratory

专题命中 软件智能体 :agentic(title,abstract);agent(abstract);分类 cs.AI、cs.LG

AI总结 AutoSAM通过多模态检索增强生成技术,自动化生成SAM代码输入文件,解决异构工程文档中提取设计数据并转换为求解器语法的难题,实现100%结构化输入利用和88%PDF文本提取。

Comments 34 Pages, 14 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20951 2026-03-27 cs.CV cs.AI 79%

See and Fix the Flaws: Enabling VLMs and Diffusion Models to Comprehend Visual Artifacts via Agentic Data Synthesis

查看并修复缺陷:通过代理数据合成使VLMs和扩散模型能够理解视觉缺陷

Jaehyun Park, Minyoung Ahn, Minkyu Kim, Jonghyun Lee, Jae-Gil Lee, Dongmin Park

机构 * KAIST(韩国科学技术院) Seoul National University(首尔国立大学) KRAFTON

专题命中 软件智能体 :agentic(title);agent(abstract);分类 cs.AI

AI总结 本文提出ArtiAgent,通过代理数据合成生成真实与带缺陷图像对,有效减少视觉缺陷,提升模型对视觉缺陷的理解能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24738 2026-03-27 cs.DC cs.AI cs.LG cs.MA 73%

Decentralized Task Scheduling in Distributed Systems: A Deep Reinforcement Learning Approach

分布式系统中的去中心化任务调度:一种深度强化学习方法

Daniel Benniah John

专题命中 软件智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出基于深度强化学习的去中心化多智能体框架,用于解决异构分布式系统中的任务调度问题,通过轻量级架构提升效率与资源利用率。

Comments 12 pages, 8 figures. Under review. Code available at GitHub

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25697 2026-03-27 cs.SE cs.AI 62%

The Kitchen Loop: User-Spec-Driven Development for a Self-Evolving Codebase

厨房循环:用户驱动的自演化代码库开发

Yannick Roy

专题命中 软件智能体 :agent(abstract);分类 cs.AI、cs.SE

AI总结 本文提出厨房循环框架,通过统一信任模型实现自主演化软件,包含规范表面、用户模拟、不可战胜测试和漂移控制,验证两个生产系统285+次迭代,产生1,094+合并请求且无回归。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25146 2026-03-27 cs.SE cs.AI 62%

Factors Influencing the Quality of AI-Generated Code: A Synthesis of Empirical Evidence

影响人工智能生成代码质量的因素:一项经验证据的综合分析

Vehid Geruslu, Zulfiyya Aliyeva, Eray Tüzün

机构 * Queen’s University Belfast(贝尔法斯特女王大学) Azerbaijan Technical University(阿塞拜疆技术大学) MilliSoft MMC Corporation(MilliSoft MMC公司) Bilkent University(比尔肯特大学)

专题命中 软件智能体 :workflow(abstract);分类 cs.AI、cs.SE

AI总结 本研究综合现有经验证据,分析影响人工智能生成源代码质量的因素,并探讨这些因素在不同评估情境下的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21149 2026-03-27 cs.SE cs.AI cs.MA 62%

Emergent Formal Verification: How an Autonomous AI Ecosystem Independently Discovered SMT-Based Safety Across Six Domains

涌现形式验证:自主AI生态系统如何在六个领域独立发现基于SMT的安全性

Octavian Untila

机构 * Aisophical SRL

专题命中 软件智能体 :AI agent(abstract);分类 cs.AI、cs.SE

AI总结 自主AI生态系统在无显式形式方法指令下,独立在六个AI安全领域发现SMT求解器的应用,提出统一框架实现100%准确验证。

Comments 10 pages, 3 figures, 5 tables. Code: https://github.com/octavuntila-prog/substrate-guard. Companion paper: https://doi.org/10.5281/zenodo.19157571

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25255 2026-03-27 cs.CV cs.LG 57%

Hyperspectral Trajectory Image for Multi-Month Trajectory Anomaly Detection

超光谱轨迹图像用于多月轨迹异常检测

Md Awsafur Rahman, Chandrakanth Gudavalli, Hardik Prajapati, B. S. Manjunath

机构 * UC Santa Barbara(加州大学圣塔芭芭拉分校)

专题命中 软件智能体 :agent(abstract);分类 cs.LG

AI总结 本文提出TITAnD方法,将轨迹异常检测转化为视觉问题,通过超光谱轨迹图像统一稀疏和密集轨迹表示,实现高效的多月异常检测。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. GUI与网页智能体 1 篇

2603.25382 2026-03-27 cs.RO 50%

IntentReact: Guiding Reactive Object-Centric Navigation via Topological Intent

IntentReact: 通过拓扑意图引导以对象为中心的反应式导航

Yanmei Jiao, Anpeng Lu, Wenhan Hu, Rong Xiong, Yue Wang, Huajin Tang, Wen-an Zhang

机构 * School of Information Science and Engineering, Hangzhou Normal University(杭州师范大学信息科学与工程学院) State Key Laboratory of Industrial Control and Technology, Zhejiang University(浙江大学工业控制技术国家重点实验室) Neuromorphic Computing and Robotic Cognition Lab, Zhejiang University(浙江大学神经形态计算与机器人认知实验室) Department of Automation, Zhejiang University of Technology(浙江工业大学自动化系)

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 本文提出IntentReact框架,通过将全局拓扑指导编码为方向信号来引导机器人以对象为中心的反应式导航,提升导航精度与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 记忆与上下文管理 5 篇

2603.25097 2026-03-27 cs.AI 79%

ElephantBroker: A Knowledge-Grounded Cognitive Runtime for Trustworthy AI Agents

ElephantBroker:一个基于知识的认知运行时用于可信AI代理

Cristian Lupascu, Alexandru Lupascu

机构 * Elephant Broker(大象经纪人)

专题命中 记忆与上下文管理 :AI agent(title);agent(abstract);分类 cs.AI

AI总结 本文提出ElephantBroker,一个结合Neo4j知识图谱与Qdrant向量存储的认知运行时,通过Cognee SDK实现可信AI代理的记忆管理,包含认知循环、证据验证、安全防护等模块,支持多部署层级和安全审计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25138 2026-03-27 quant-ph cs.AI cs.LG 62%

Reinforcement learning for quantum processes with memory

具有记忆的量子过程的强化学习

Josep Lumbreras, Ruo Cheng Huang, Yanglin Hu, Marco Fanizza, Mile Gu

机构 * Inria(法国国家信息与自动化研究所)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

AI总结 本文研究了在量子系统中应用强化学习的问题,提出了一种基于量子通道的框架,并通过乐观最大似然估计算法实现了亚线性 regret 的最优控制。

Comments 85 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25614 2026-03-27 cs.LG 57%

Social Hippocampus Memory Learning

社交海马体记忆学习

Liping Yi, Zhiming Zhao, Qinghua Hu

机构 * College of Artificial Intelligence, Tianjin University(天津大学人工智能学院)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

AI总结 本文提出SoHip框架,通过记忆共享而非模型共享实现异构智能体协作,提升预测性能,实验表明在两个基准数据集上比现有方法提升8.78%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25275 2026-03-27 cs.CV 50%

V2U4Real: A Real-world Large-scale Dataset for Vehicle-to-UAV Cooperative Perception

V2U4Real: 一种用于车辆与无人机协同感知的真实世界大规模数据集

Weijia Li, Haoen Xiang, Tianxu Wang, Shuaibing Wu, Qiming Xia, Cheng Wang, Chenglu Wen

机构 * Fujian Key Laboratory of Urban Intelligent Sensing and Computing, Xiamen University, China(福建省城市智能感知与计算重点实验室,厦门大学,中国) Key Laboratory of Multimedia Trusted Perception and Efficient Computing, Ministry of Education of China, Xiamen University, China(多媒体可信感知与高效计算教育部重点实验室,厦门大学,中国)

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 本文提出V2U4Real数据集,用于研究跨视角协同感知,包含56K激光雷达帧、56K多视角图像和700K标注的3D边界框,评估了多种先进模型,展示了V2U协作在提升感知鲁棒性和远距离感知方面的有效性。

Comments Accepted by CVPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13303 2026-03-27 cs.CV 50%

ShowTable: Unlocking Creative Table Visualization with Collaborative Reflection and Refinement

ShowTable:通过协作反思与精炼解锁创意表格可视化

Zhihang Liu, Xiaoyi Bao, Pandeng Li, Junjie Zhou, Zhaohe Liao, Yefei He, Kaixun Jiang, Chen-Wei Xie, Yun Zheng, Hongtao Xie

机构 * USTC(中国科学技术大学) CASIA(中国科学院自动化研究所) NJU(南京大学) SJTU(上海交通大学) ZJU(浙江大学) FDU(福建师范大学) Tongyi Lab(通义实验室)

专题命中 记忆与上下文管理 :planning(abstract)

AI总结 本文提出ShowTable框架,结合大语言模型与扩散模型,通过逐步自我纠正过程实现创意表格可视化,引入TableVisBench基准测试,展示其在多模态推理、生成和纠错方面的优势。

Comments Accepted to CVPR 2026, project page: https://lntzm.github.io/showtable-page/

详情

展开后加载摘要…

URL PDF HTML 收藏

5. Agent评测 18 篇

2603.25001 2026-03-27 cs.AI 88%

Rethinking Failure Attribution in Multi-Agent Systems: A Multi-Perspective Benchmark and Evaluation

重新思考多智能体系统中的故障归因:一个多视角基准和评估

Yeonjun In, Mehrab Tanjim, Jayakumar Subramanian, Sungchul Kim, Uttaran Bhattacharya, Wonjoong Kim, Sangwu Park, Somdeb Sarkhel, Chanyoung Park

机构 * Adobe Research(Adobe研究院)

专题命中 Agent评测 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 本文提出多视角故障归因方法,引入MP-Bench基准,通过实验发现现有基准设计限制导致LLM在故障归因上的表现问题,强调多视角评估的重要性。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24775 2026-03-27 cs.CR cs.AI 85%

AIP: Agent Identity Protocol for Verifiable Delegation Across MCP and A2A

基于MCP和A2A的可验证代理身份协议

Sunil Prakash

机构 * Indian School of Business(印度商学院)

专题命中 Agent评测 :agent(title,abstract);AI agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文提出AIP协议,通过融合身份、授权衰减和溯源绑定,解决MCP和A2A协议中代理身份验证问题,采用IBCTs实现多跳委托,并在实际部署中展示高效安全性能。

Comments 17 pages, 10 tables, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25253 2026-03-27 cs.CL cs.AI 81%

MolQuest: A Benchmark for Agentic Evaluation of Abductive Reasoning in Chemical Structure Elucidation

MolQuest: 一个用于化学结构解析中代理评估归纳推理的基准

Taolin Han, Shuang Wu, Jinghang Wang, Yuhao Zhou, Renquan Lv, Bing Zhao, Wei Hu

机构 * Alibaba Group(阿里巴巴集团)

专题命中 Agent评测 :agentic(title);agent(abstract);分类 cs.AI、cs.CL

AI总结 MolQuest通过多轮交互任务评估LLM在复杂化学任务中的归纳推理与策略决策能力,揭示当前模型在真实科学场景中的局限性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25068 2026-03-27 cs.MA cs.LG 79%

Ultra-fast Traffic Nowcasting and Control via Differentiable Agent-based Simulation

通过可微代理模拟实现超快交通现在预测与控制

Fumiyasu Makinoshima, Yuya Yamaguchi, Eigo Segawa, Koichiro Niinuma, Sean Qian

机构 * Fujitsu Limited(富士通株式会社) Fujitsu Research of America(富士通美国研究院) Carnegie Mellon University(卡内基梅隆大学)

专题命中 Agent评测 :agent(title,abstract);分类 cs.LG

AI总结 本文提出一种可微代理交通模拟器,实现大规模网络的超快模型校准、交通现在预测与控制,通过可微计算技术提升效率,实现30分钟数据校准、1小时预测和728秒控制,构建完整的校准-预测-控制闭环。

详情

展开后加载摘要…

URL PDF HTML 收藏