arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-03-17 至 2026-03-17 共收录 270 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工作流自动化 42 篇

2510.02854 2026-03-17 cs.SE 57%

C2|Q>: A Robust Framework for Bridging Classical and Quantum Software Development

C2|Q>: 一种连接经典与量子软件开发的稳健框架

Boshuai Ye, Arif Ali Khan, Teemu Pihkakoski, Peng Liang, Muhammad Azeem Akbar, Matti Silveri, Lauri Malmi

专题命中 工作流自动化 :workflow(abstract);分类 cs.SE

AI总结 C2|Q>通过模块化方法将经典规范转化为量子可执行程序,降低量子软件开发门槛,实验证明其在模拟和真实量子硬件上均具可靠性。

Comments Preprint accepted for publication in ACM Transactions on Software Engineering and Methodology (TOSEM), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15503 2026-03-17 cond-mat.mtrl-sci 50%

High-Throughput Computational Exploration of MOFs for Short-Chain PFAS Removal

高通量计算探索用于短链PFAS去除的MOFs

Mengru Zhang, Satyanarayana Bonakala, Taku Watanabe, Karim Hamzaoui, Guillaume Maurin

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出一种高通量计算筛选策略,用于识别高性能MOFs用于水中的短链PFAS吸附,结合经典力场和u-MLIP实现准确预测和设计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15498 2026-03-17 physics.optics quant-ph 50%

A systematic design approach for one-dimensional and crossed photonic nanobeam cavities for quantum dot integration

一维及交叉光子纳米束腔系统化设计方法用于量子点集成

Oscar Camacho Ibarra, Jan-Gabriel Hartel, Atzin David Ruiz Perez, Sonja Barkhofen, Klaus D. Jöns

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出了一种系统化方法,用于设计一维及交叉光子纳米束腔,通过优化晶格周期性、空气孔几何和腔体长度,实现对光学束缚的精确控制并减少辐射损失,为量子点集成提供了高效优化路径。

Comments 12 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15294 2026-03-17 cond-mat.mtrl-sci physics.comp-ph 50%

UniMatSim: A High-Throughput Materials Simulation Automation Framework Based on Universal Machine Learning Potentials

UniMatSim:基于通用机器学习势的高通量材料模拟自动化框架

Yanjin Xiang, Yihan Nie, Yunzhi Gao, Haidi Wang, Wei Hu

专题命中 工作流自动化 :workflow(abstract)

AI总结 UniMatSim通过整合多种UMLIPs,实现从结构优化到稳定性验证的自动化工作流,提升计算效率和可重复性,为数据驱动的材料发现提供可靠基础。

Comments 14 pages main text, 17 pages Supporting Information, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14820 2026-03-17 math.DG 50%

Local Equivalence of Riemannian Submersions via Differential Invariants

利用微分不变量研究黎曼子浸入的局部等价性

Xurshid Sharipov, Sadoqat Sharipova, Esanjon Salimov, Islomkhon Mardiev

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文通过微分不变量研究黎曼子浸入在纤维保持等距下的局部等价问题,分析了由非零 Killing 场诱导的轨道子浸入,并给出了基于基数据的等价判据。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12372 2026-03-17 cs.CV 50%

STAGE: Storyboard-Anchored Generation for Cinematic Multi-shot Narrative

STAGE:基于故事板的电影多镜头叙事生成

Peixuan Zhang, Zijian Jia, Kaiqi Liu, Shuchen Weng, Si Li, Boxin Shi

专题命中 工作流自动化 :workflow(abstract)

AI总结 STAGE提出基于故事板的生成方法,通过结构化故事板和多镜头记忆包提升叙事控制与跨镜头一致性,引入ConStoryBoard数据集进行实验验证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03221 2026-03-17 cs.DL 50%

ExtracTable: Human-in-the-Loop Transformation of Scientific Corpora into Structured Knowledge

ExtracTable:人机协同将科学语料库转化为结构化知识

Lena John, Ahmed Malek Ghanmi, Tim Wittenborg, Sören Auer, Oliver Karras

专题命中 工作流自动化 :workflow(abstract)

AI总结 ExtracTable通过结合大语言模型与用户定义的模式,实现科学文献到结构化知识的转化,提升知识组织效率,降低人工干预成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.16945 2026-03-17 cs.CV 50%

Revisiting Face Forgery Detection: From Facial Representation to Forgery Detection

重新审视面部伪造检测:从面部表示到伪造检测

Zonghui Guo, Yingjie Liu, Jie Zhang, Haiyong Zheng, Shiguang Shan

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出通过自监督预训练和竞争学习机制改进面部伪造检测,提升泛化能力并应用于其他面部任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14607 2026-03-17 quant-ph 50%

Evaluating Calibration-Based Digital Twins for IBM Quantum Hardware Simulation

评估基于校准的数字孪生用于IBM量子硬件模拟

Edgars Bautra, Maksims Dimitrijevs, Abuzer Yakaryilmaz

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文评估基于校准的数字孪生用于IBM量子硬件模拟,通过对比不同孪生变体,探讨校准数据与后端衍生模型在不同设备和编译设置下的表现差异。

Comments 16 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14031 2026-03-17 cs.CV 50%

Intrinsic Tolerance in C-Arm Imaging: How Extrinsic Re-optimization Preserves 3D Reconstruction Accuracy

C臂成像的内在容忍度:如何通过外在重新优化保持3D重建精度

Lin Li, Benjamin Aubert, Paul Kemper, Aric Plumley

专题命中 工作流自动化 :workflow(abstract)

AI总结 研究通过重新优化外在参数补偿内在校准误差,证明在存在一定内在校准误差时,能保持3D重建精度,为简化C臂系统设置提供了可行路径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.17854 2026-03-17 math.OC math.DS 50%

PIETOOLS 2025: User Manual

PIETOOLS 2025:用户手册

Sachin Shivakumar, Declan Jagt, Danilo Braghini, Amritam Das, Yulia Peet, Matthew Peet

专题命中 工作流自动化 :workflow(abstract)

AI总结 PIETOOLS 2025用户手册介绍该MATLAB工具箱的核心功能,包括将耦合ODE-PDEs、DDEs等转换为PIE表示,分析PIE稳定性及输入输出特性,设计最优观测器和控制器,以及模拟开闭环PIE系统。

Comments See also https://control.asu.edu/pietools/pietools . Codes available at https://github.com/CyberneticSCL/PIETOOLS

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13803 2026-03-17 cs.CV 50%

ALTIS: Automated Loss Triage and Impact Scoring from Sentinel-1 SAR for Property-Level Flood Damage Assessment

ALTIS:基于哨兵-1 SAR的自动化损失分级与影响评分用于财产级洪水损害评估

Amogh Vinaykumar, Prem Kamasani

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出ALTIS系统,利用哨兵-1 SAR数据在24-48小时内生成财产级影响评分,结合多时相SAR变化检测、物理模型深度估计等方法,提升洪水损失评估效率和准确性。

Comments 27 pages, 9 figures. Preliminary results; full end-to-end validation ongoing

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13668 2026-03-17 cs.DC cs.CY cs.HC 50%

Audo-Sight: AI-driven Ambient Perception Across Edge-Cloud for Blind and Low Vision Users

Audo-Sight:基于边缘-云的AI驱动环境感知系统用于视障和低视力用户

Jacob Bradshaw, Mohsen Riahi Alam, Bhanuja Ainary, Minseo Kim, Mohsen Amini Salehi

专题命中 工作流自动化 :AI agent(abstract)

AI总结 本文提出Audo-Sight系统,通过边缘-云协同实现视障用户环境感知,利用AI代理动态路由查询,融合边缘快速响应与云准确信息,提升响应速度和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13646 2026-03-17 stat.ME 50%

Surrogate-Based Bayesian Inference: Uncertainty Quantification and Active Learning

基于代理的贝叶斯推断:不确定性量化与主动学习

Andrew Gerard Roberts, Michael C. Dietze, Jonathan H. Huggins

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文综述了代理模型在贝叶斯推断中的应用,重点探讨了代理不确定性传播和主动学习在提升鲁棒性中的作用,为从业者和方法开发者提供统一框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13504 2026-03-17 cs.CE 50%

ADIOSS Automatic Diagnostic Of System Simulations

ADIOSS 自动诊断系统仿真

Di Jiang, Sebastian Rodriguez, Herve Colin, Yves Tourbier, Francisco Chinesta

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出一种自动诊断系统仿真方法,通过图表示0D模型检测故障模块,利用动态模式分解、线性规划和自编码器等技术,减少仿真成本和周期。

Comments Submitted to Mechanics & Industry. 18 pages, 9 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13358 2026-03-17 cs.NI 50%

Not All Prefills Are Equal: PPD Disaggregation for Multi-turn LLM Serving

并非所有预填充都相同:多轮LLM服务中的PPD拆分

Zongze Li, Jingyu Liu, Zach Xu, Yineng Zhang, Tahseen Rabbani, Ce Zhang

专题命中 工作流自动化 :agentic(abstract)

AI总结 本文提出PPD拆分架构,通过动态路由减少多轮交互中的KV传输拥堵,提升TTFT性能同时保持TPOT效率。

Comments 14 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 软件智能体 13 篇

2603.14703 2026-03-17 cs.SE cs.AI 90%

Beyond Local Code Optimization: Multi-Agent Reasoning for Software System Optimization

超越局部代码优化:软件系统优化的多智能体推理

Huiyun Peng, Parth Vinod Patil, Antonio Zhong Qiu, George K. Thiruvathukal, James C. Davis

专题命中 软件智能体 :agent(title,abstract);multi-agent(title,abstract);AI agent(abstract);分类 cs.AI、cs.SE

AI总结 本文提出多智能体框架,通过整合控制流、数据流与架构依赖信号,实现微服务系统的整体优化,提升吞吐量和响应时间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14373 2026-03-17 cs.SE 88%

Trust Over Fear: How Motivation Framing in System Prompts Affects AI Agent Debugging Depth

信任胜过恐惧:系统提示中的动机框架如何影响AI代理调试深度

Wu Ji

专题命中 软件智能体 :agent(title,abstract);AI agent(title,abstract);分类 cs.SE

AI总结 研究探讨了信任与恐惧动机框架对AI代理调试深度的影响,发现信任框架能显著提升问题发现和调查步骤,而恐惧框架无明显效果,揭示了动机框架对AI行为的关键作用。

Comments 13 pages, 2 tables, 23 references. Code and data: https://github.com/wuji-labs/nopua

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13723 2026-03-17 cs.SE 85%

Do AI Agents Really Improve Code Readability?

AI代理真的能提高代码可读性吗?

Kyogo Horikawa, Kosei Horikawa, Yutaro Kashiwa, Hidetake Uwano, Hajimu Iida

专题命中 软件智能体 :AI agent(title,abstract);agent(abstract);planning(abstract);分类 cs.SE

AI总结 研究探讨AI代理重构对代码可读性的影响,通过分析403个提交发现,AI主要改进逻辑复杂度和文档,但导致传统质量指标下降。

Comments 5 pages

Journal ref 23rd International Conference on Mining Software Repositories (MSR '26) , 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13258 2026-03-17 cs.LG cs.AI cs.SE 83%

Your Code Agent Can Grow Alongside You with Structured Memory

你的代码代理可以与你一同成长,借助结构化记忆

Yi-Xuan Deng, Xiaoqin Liu, Yi Zhang, Guo-Wei Yang, Shuojin Yang

机构 * Tsinghua University(清华大学)

专题命中 软件智能体 :agent(title,abstract);分类 cs.AI、cs.LG、cs.SE

AI总结 本文提出MemCoder框架,通过结构化记忆和实时反馈实现人类与AI的持续共进化,提升代码代理在复杂软件工程任务中的性能。

Comments Code Agent

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14417 2026-03-17 cs.CY cs.AI cs.CL cs.LG 82%

Questionnaire Responses Do not Capture the Safety of AI Agents

问卷回复无法捕捉AI代理的安全性

Max Hellrigel-Holderbaum, Edward James Young

专题命中 软件智能体 :AI agent(title,abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文指出问卷式评估无法准确衡量AI代理的安全性,因LLM在情景中的表现与实际代理行为存在差异,导致评估方法缺乏有效性。

Comments 31 pages, 11 pages main text

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13724 2026-03-17 cs.SE 79%

Testing with AI Agents: An Empirical Study of Test Generation Frequency, Quality, and Coverage

利用AI代理进行测试:一项关于测试生成频率、质量和覆盖度的实证研究

Suzuka Yoshimoto, Shun Fujita, Kosei Horikawa, Daniel Feitosa, Yutaro Kashiwa, Hajimu Iida

专题命中 软件智能体 :AI agent(title);agent(abstract);分类 cs.SE

AI总结 本研究通过AIDev数据集分析AI代理生成测试的频率、结构特征及对代码覆盖率的影响,发现AI生成的测试在代码长度和断言密度上表现突出,且能实现与人工测试相当的覆盖率提升。

Comments 5 pages

Journal ref 23rd International Conference on Mining Software Repositories (MSR '26) , 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13380 2026-03-17 cs.DB cs.AI 79%

Querying Everything Everywhere All at Once: Supervaluationism for the Agentic Lakehouse

全方位查询:代理湖house的超估值主义

Jacopo Tagliabue

机构 * Bauplan Labs(Bauplan实验室)

专题命中 软件智能体 :agentic(title,abstract);分类 cs.AI

AI总结 本文提出一种新型查询方法,通过超估值语义在多个数据分支上回答问题,解决了传统OLAP系统无法处理多分支查询的局限。

Comments Pre-print submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15538 2026-03-17 quant-ph 75%

QiboAgent: a practitioner's guideline to open source assistants for Quantum Computing code development

QiboAgent:量子计算代码开发开源助手的实践指南

Lorenzo Esposito, Andrea Papaluca, Stefano Carrazza

专题命中 软件智能体 :autonomous agent(abstract);workflow(abstract);agentic(abstract)

AI总结 本文提出QiboAgent,通过轻量级开源大语言模型与定制工作流架构,提升量子计算中间件代码生成的准确性和自动化能力,实现90.2%的高精度代码生成。

Comments 13 pages, 9 figures, 1 table. Source code and deployment instructions are publicly available at https://github.com/qiboteam/qiboagent

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13023 2026-03-17 cs.SE cs.AI cs.CL 75%

daVinci-Env: Open SWE Environment Synthesis at Scale

daVinci-Env:大规模开放软件工程环境合成

Dayuan Fu, Shenyu Wu, Yunze Wu, Zerui Peng, Yaxing Huang, Jie Sun, Ji Zeng, Mohan Jiang, Lin Zhang, Yukun Li, Jiarui Hu, Liming Liu, Jinlong Hou, Pengfei Liu

专题命中 软件智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.CL、cs.SE

AI总结 本文提出OpenSWE,一个大规模透明的软件工程代理训练框架,包含45320个可执行Docker环境,通过多代理合成管道和质量过滤流程,实现高效学习和高质量训练。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15566 2026-03-17 cs.SE cs.AI cs.SY eess.SY 62%

Lore: Repurposing Git Commit Messages as a Structured Knowledge Protocol for AI Coding Agents

Lore:将Git提交信息重新利用为AI编码代理的结构化知识协议

Ivan Stetsenko

专题命中 软件智能体 :agent(abstract);分类 cs.AI、cs.SE

AI总结 本文提出Lore协议,通过Git trailers重构提交信息,生成包含约束、拒绝替代方案、代理指令和验证元数据的自包含决策记录,以解决AI编码代理在代码生产与消费中机构知识流失的问题。

Comments 8 pages, 1 figure, 1 table. Preprint available at https://doi.org/10.5281/zenodo.19051840

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13640 2026-03-17 cs.LG cs.SE 62%

SemRep: Generative Code Representation Learning with Code Transformations

SemRep:基于代码变换的生成式代码表示学习

Weichen Li, Jiamin Song, Bogdan Alexandru Stoica, Arav Dhoot, Gabriel Ryan, Shengyu Fu, Kexin Pei

机构 * The University of Chicago(芝加哥大学) Columbia University(哥伦比亚大学) Microsoft(微软公司)

专题命中 软件智能体 :agent(abstract);分类 cs.LG、cs.SE

AI总结 SemRep通过生成式代码表示学习提升代码变换效果,利用语义保持变换作为中间表示,实现更准确的语义推理和更高效的代码优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.18328 2026-03-17 cs.CV cs.AI 57%

Virtual Full-stack Scanning of Brain MRI via Imputing Any Quantised Code

通过填补任意量化代码实现脑部MRI的虚拟全栈扫描

Yicheng Wu, Tao Song, Zhonghua Wu, Jin Ye, Zongyuan Ge, Wenjia Bai, Zhaolin Chen, Jianfei Cai

专题命中 软件智能体 :workflow(abstract);分类 cs.AI

AI总结 本文提出CodeBrain框架,通过区域级全栈代码预测解决MRI模态缺失问题,提升数据完整性和临床实用性。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13399 2026-03-17 cs.CV 50%

FlowAD: Ego-Scene Interactive Modeling for Autonomous Driving

FlowAD: 无人驾驶中的自体场景交互建模

Mingzhe Guo, Yixiang Yang, Chuanrong Han, Rufeng Zhang, Shirui Li, Ji Wan, Zhipeng Zhang

机构 * AutoLab, School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院AutoLab) Baidu Inc(百度公司)

专题命中 软件智能体 :planning(abstract)

AI总结 本文提出FlowAD框架,通过自体场景交互建模提升自动驾驶性能,利用场景流建模动态变化,结合新颖的FCP指标评估场景理解能力,实验表明其在碰撞率和驾驶评分上均优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. GUI与网页智能体 10 篇

2603.15039 2026-03-17 cs.CV 75%

GUI-CEval: A Hierarchical and Comprehensive Chinese Benchmark for Mobile GUI Agents

GUI-CEval: 一种用于移动GUI代理的分层和全面的中文基准

Yang Li, Yuchen Liu, Haoyu Lu, Zhiqiang Xia, Hongzhen Wang, Kaiyang Han, Changpeng Yang, Jinyang Wu, Jiaming Xu, Runyu Shi, Ying Huang

机构 * HyperAI Team, Xiaomi Corporation(HyperAI团队,小米公司)

专题命中 GUI与网页智能体 :agent(abstract);planning(abstract);multi-agent(abstract)

AI总结 本文提出GUI-CEval,首个针对中文移动GUI代理的全面基准,涵盖201款主流应用,通过分层结构评估感知、规划、反思、执行和评估五方面能力,验证模型在真实交互中的表现。

Comments accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏