arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-03-31 至 2026-03-31 共收录 214 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工作流自动化 32 篇

2603.26965 2026-03-31 cs.SE cs.DC 57%

Efficiently Reproducing Distributed Workflows in Notebook-based Systems

在基于笔记的系统中高效重现分布式工作流

Talha Azaz, Raza Ahmad, Md Saiful Islam, Douglas Thain, Tanu Malik

专题命中 工作流自动化 :workflow(abstract);分类 cs.SE

AI总结 本文提出NBRewind系统,通过增量检查点和日志提升分布式工作流在笔记中的可重现性与效率,减少全量重执行开销。

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28636 2026-03-31 math.CO math.NT 50%

Optimal bounds for an Erdős problem on matching integers to distinct multiples

关于埃尔多斯问题的最优界限

Wouter van Doorn, Yanyang Li, Quanyu Tang

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文研究了将整数匹配到不同倍数的问题,确定了最优界限f(m)=min(m,⌈2√m⌉),并通过AI辅助流程证明。

Comments 8 pages. Comments and suggestions are welcome

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28505 2026-03-31 physics.ins-det hep-ex nucl-ex 50%

Process Development and First Cryogenic Operation of Compact Germanium Ring-Contact HPGe Prototypes

紧凑型锗环接触高纯锗探测器的工艺开发与首次低温操作

Kunming Dong, Shasika Panamaldeniya, Dongming Mei

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文报道了两种紧凑型n型GeRC工艺验证原型的制备与首次低温操作,验证了GeRC几何结构的可行性,为后续大规模生产奠定了基础。

Comments 27 pages, 12 figures and 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27972 2026-03-31 math.OC 50%

A Framework for Exploring Social Interactions in Multiagent Decision-Making for Two-Queue Systems

多队列系统中多智能体决策的社交互动探索框架

Mallory E. Gaspard, Naomi Ehrich Leonard

专题命中 工作流自动化 :agent(abstract)

AI总结 本文提出一个新框架,利用非线性意见动态的敏捷性和鲁棒性,通过队列选择中的决策突破和捕捉社交互动对集体行为的影响。

Comments Submitted to the 2026 IEEE Conference on Decision and Control

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27870 2026-03-31 cs.NI 50%

Energy Efficient Orchestration in Multiple-Access Vehicular Aerial-Terrestrial 6G Networks

多接入车载天地6G网络中的能效编排

Mohammad Farhoudi, Hamidreza Mazandarani, Masoud Shokrnezhad, Tarik Taleb, Ignacio Lacalle

专题命中 工作流自动化 :planning(abstract)

AI总结 本文提出一种新型框架,整合无人机轨迹规划、多接入控制和服务放置,以实现高效能服务覆盖和超低延迟通信,解决动态车载环境中的干扰、资源稀缺和移动性挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27801 2026-03-31 cs.GR cs.CV cs.CY cs.RO 50%

Engineering Mythology: A Digital-Physical Framework for Culturally-Inspired Public Art

神话工程:一种融合文化灵感的公共艺术数字-物理框架

Jnaneshwar Das, Christopher Filkins, Rajesh Moharana, Ekadashi Barik, Bishweshwar Das, David Ayers, Christopher Skiba, Rodney Staggers, Mark Dill, Swig Miller, Daniel Tulberg, Patrick Smith, Seth Brink, Kyle Breen, Harish Anand, Ramon Arrowsmith

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文介绍了为Burn Man 2025设计的'Navagunjara Reborn'项目所采用的数字-物理工作流程,融合神话、工艺与计算,探讨了跨学科合作与文化传承的未来框架。

Comments 19 pages, 28 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26142 2026-03-31 cs.HC 50%

Simulating Novice Students Using Machine Unlearning and Relearning in Large Language Models

利用机器去学习和再学习在大语言模型中模拟新手学生

Jiajia Song, Zhihan Guo, Jionghao Lin

专题命中 工作流自动化 :agent(abstract)

AI总结 本文提出基于机器去学习的知识级模拟方法,通过转换知识丰富的LLM为新手级AI学生,评估其通过教学对话重新学习知识的能力,揭示了学生行为随时间的变化轨迹。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00382 2026-03-31 cs.HC 50%

Unseen Risks of Clinical Speech-to-Text Systems: Transparency, Privacy, and Reliability Challenges in AI-Driven Documentation

临床语音转文本系统未见的风险:人工智能驱动的文档中透明性、隐私和可靠性挑战

Nelly Elsayed

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文研究了临床语音转文本系统在透明性、隐私和可靠性方面的风险,提出了一种社会技术框架来识别和管理相关风险,强调透明性、患者自主权和问责制的重要性。

Comments Accepted in the International Journal of Medical Informatics

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15839 2026-03-31 q-bio.QM 50%

Comparing Bayesian and Frequentist Inference in Biological Models: A Comparative Analysis of Accuracy, Uncertainty, and Identifiability

比较生物模型中的贝叶斯推断与频率主义推断:准确性、不确定性和可识别性的比较分析

Mohammed A. Y. Mohammed, Hamed Karami, Gerardo Chowell

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文比较了贝叶斯与频率主义推断在生物模型中的表现,通过三个模型和四个数据集评估了准确性、不确定性和可识别性,发现频率主义在数据丰富时表现最佳,而贝叶斯在数据稀疏且存在潜在状态不确定性时更优。

Comments 59 pages, 19 figures, 29 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27464 2026-03-31 cs.DB cs.MM 50%

NeedleDB: A Generative-AI Based System for Accurate and Efficient Image Retrieval using Complex Natural Language Queries

NeedleDB: 一种基于生成式AI的图像检索系统,用于通过复杂自然语言查询实现精确高效的检索

Mahdi Erfanian, Abolfazl Asudeh

专题命中 工作流自动化 :workflow(abstract)

AI总结 NeedleDB通过生成式AI合成引导图像,将文本到图像检索转化为图像到图像搜索,提升复杂查询的精度和效率,实现93%的精度提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27202 2026-03-31 cs.PL cs.DC 50%

Sal: Multi-modal Verification of Replicated Data Types

Sal:多模态验证复制数据类型

Pranav Ramesh, Vimala Soundarapandian, KC Sivaramakrishnan

专题命中 工作流自动化 :workflow(abstract)

AI总结 Sal通过结合内核可验证的自动化、SMT辅助自动化及AI辅助交互式定理证明,实现CRDT和MRDT的多模态验证,69%的验证条件由内核验证自动化解决,自动生成反例暴露隐秘错误。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27162 2026-03-31 cs.HC cs.GR 50%

BrainRing: An Interactive Web-Based Tool for Brain Connectivity Chord Diagram Visualization

BrainRing: 一种用于脑连接弦图可视化交互式网页工具

Xiao Fan, Yi Zhang

专题命中 工作流自动化 :workflow(abstract)

AI总结 BrainRing是一款无需安装或编程的交互式网页工具,可生成高质量的脑连接弦图,支持多种脑图集,提供实时参数调整和全面的边管理功能,实现快速生成出版级图像。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27106 2026-03-31 physics.chem-ph cond-mat.mtrl-sci 50%

ADEPT-PolyGraphMT: Automated Molecular Simulation and Multi-Task Multi-Fidelity Machine Learning for Polymer Property Generation and Prediction

ADEPT-PolyGraphMT:自动化分子模拟与多任务多保真度机器学习用于聚合物性质生成与预测

Sobin Alosious, Yuhan Liu, Jiaxin Xu, Gang Liu, Renzheng Zhang, Meng Jiang, Tengfei Luo

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出结合自动化分子动力学引擎与多任务多保真度机器学习的聚合物信息学框架,通过分子图神经网络学习结构-性质关系,利用模拟数据与实验数据构建62000个聚合物性质数据集,实现多任务学习在预测聚合物性质中的高效应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11478 2026-03-31 q-bio.NC cs.SY eess.SY 50%

Defining causal mechanism in dual process theory and two types of feedback control

在双过程理论中定义因果机制及两种反馈控制

Yoshiyuki Ohmura, Yasuo Kuniyoshi

专题命中 工作流自动化 :agent(abstract)

AI总结 本文提出通过整合双过程理论与跨层级因果机制,构建意识和自主决定模型,统一了意识、代理和双过程理论,揭示了类型1和类型2过程的特征。

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.04280 2026-03-31 physics.flu-dyn physics.data-an 50%

Estimating density, velocity, and pressure fields in supersonic flow using physics-informed BOS

利用物理指导的BOS估计超音速流动的密度、速度和压力场

Joseph P. Molnar, Lakshmi Venkatakrishnan, Bryan E. Schmidt, Timothy A. Sipkens, Samuel J. Grauer

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出了一种名为物理指导BOS的方法,通过物理信息神经网络同时满足测量数据和控制方程,提高超音速流动中密度估计的准确性,并获得速度和压力数据。

Journal ref Exp. Fluids 64 (2023) 14

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26822 2026-03-31 physics.soc-ph math.DS q-bio.PE 50%

Modularity, asymmetry, and polarization shape consensus speed in the voter model

模ularity、asymmetry和polarization如何影响voter模型中的共识速度

Madi Yerlanov, Zachary Kilpatrick, Nancy Rodriguez

专题命中 工作流自动化 :agent(abstract)

AI总结 研究探讨了模ularity、asymmetry和polarization如何影响voter模型中共识形成速度,通过分析双群体结构下的意见扩散过程,揭示了共识形成中的快慢阶段及影响因素。

Comments 23 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 软件智能体 22 篇

2603.28428 2026-03-31 cs.CY cs.MA 89%

Synergy: A Next-Generation General-Purpose Agent for Open Agentic Web

Synergy: 一个下一代通用智能体用于开放性智能体网络

Xiaohang Nie, Zihan Guo, Kezhuo Yang, Zhichong Zheng, Bochen Ge, Shuai Pan, Zeyi Chen, Youling Xiang, Yu Zhang, Weiwen Liu, Yuanjian Zhou, Weinan Zhang

专题命中 软件智能体 :agent(title,abstract);agentic(title,abstract);AI agent(abstract)

AI总结 本文提出Synergy,一个用于开放性智能体网络的通用智能体架构,强调智能体间的协作、身份管理和持续进化,以实现开放网络中的社会集成。

Comments A tech report of a general-purpose agent architecture and human-agent society, 21 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27524 2026-03-31 cs.SE cs.AI 86%

Safer Builders, Risky Maintainers: A Comparative Study of Breaking Changes in Human vs Agentic PRs

更安全的构建者,危险的维护者:人类与代理PR中破坏性变更的比较研究

K M Ferdous, Dipayan Banik, Kowshik Chowdhury, Shazibul Islam Shamim

机构 * Kennesaw State University(肯尼索州立大学)

专题命中 软件智能体 :agentic(title,abstract);agent(abstract);AI agent(abstract);分类 cs.AI、cs.SE

AI总结 本文比较了人类与代理PR中破坏性变更的频率和任务情境,发现代理在维护任务中风险更高,存在'信心陷阱'问题。

Comments Accepted at 23rd International Conference on Mining Software Repositories (MSR), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19347 2026-03-31 cs.AR cs.LG 83%

Exploring the Agentic Frontier of Verilog Code Generation

探索Verilog代码生成的代理前沿

Patrick Yubeaton, Siddharth Garg, Chinmay Hegde

机构 * New York University Tandon School of Engineering(纽约大学坦登工程学院)

专题命中 软件智能体 :agentic(title,abstract);agent(abstract);分类 cs.LG

AI总结 本文系统评估了代理LLM在Verilog生成中的影响,通过CVDP基准测试,分析了结构化提示和工具设计对性能的影响,并比较了开源与闭源模型的性能差异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08847 2026-03-31 cs.AI cs.MA 83%

What Is Your Agent's GPA? A Framework for Evaluating Agent Goal-Plan-Action Alignment

你的代理的GPA是多少?一个评估代理目标-计划-行动对齐的框架

Allison Sihan Jia, Daniel Huang, Nikhil Vytla, Seung Won Wilson Yoo, Nirvika Choudhury, Shayak Sen, John C. Mitchell, Anupam Datta

机构 * BASIS Independent Silicon Valley Upper School(BASIS独立硅谷高中) Department of Computer Science, Stanford University(斯坦福大学计算机科学系)

专题命中 软件智能体 :agent(title,abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文提出Agent GPA框架,通过评估代理目标、计划和行动的对齐性,验证其在多代理、单代理和企业数据代理中的有效性,展示了高误差覆盖和调试定位能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26990 2026-03-31 hep-ph 82%

Agentic Diagrammatica: Towards Autonomous Symbolic Computation in High Energy Physics

代理图示学:迈向高能物理中自主符号计算

Tony Menzo, Alexander Roman, George T. Fleming, Sergei Gleyzer, Konstantin T. Matchev, Stephen Mrenna

专题命中 软件智能体 :agentic(title,abstract);agent(abstract)

AI总结 本文提出Diagrammatica,通过HEPTAPOD框架扩展实现LLM代理的多步骤理论计算。通过工具约束计算和知识接地方法,实现符号计算的精确性与可验证性,验证了在高能物理中的应用效果。

Comments 54 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27850 2026-03-31 cs.SE cs.CL 81%

EffiSkill: Agent Skill Based Automated Code Efficiency Optimization

EffiSkill:基于代理技能的自动代码效率优化

Zimu Wang, Yuling Shi, Mengfan Li, Zijun Liu, Jie M. Zhang, Chengcheng Wan, Xiaodong Gu

机构 * Shanghai Jiao Tong University(上海交通大学) University of California, Berkeley(加州大学伯克利分校) Columbia University(哥伦比亚大学) King's College London(伦敦国王学院) East China Normal University(华东师范大学) Shanghai Innovation Institute(上海创新研究院)

专题命中 软件智能体 :agent(title,abstract);分类 cs.CL、cs.SE

AI总结 EffiSkill通过构建可移植的优化工具箱,利用代码效率优化机制,实现无运行反馈的代码优化,提升了优化成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03548 2026-03-31 cs.CL 79%

SEAD: Self-Evolving Agent for Multi-Turn Service Dialogue

SEAD:多轮服务对话的自演化代理

Yuqin Dai, Ning Gao, Wei Zhang, Jie Wang, Zichen Luo, Jinpeng Wang, Yujie Wang, Ruiyuan Wu, Chaozheng Wang

机构 * Meituan(美团)

专题命中 软件智能体 :agent(title,abstract);分类 cs.CL

AI总结 SEAD通过自演化机制提升服务对话性能,无需大规模人工标注,实验显示其任务完成率和对话效率均优于开源和商用模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09701 2026-03-31 cs.SE 70%

An Empirical Study of Interaction Smells in Multi-Turn Human-LLM Collaborative Code Generation

多轮人-大语言模型协作代码生成中交互恶臭的实证研究

Binquan Zhang, Li Zhang, Lin Shi, Song Wang, Yuwei Qian, Linhui Zhao, Fang Liu, An Fu, Yida Ye

专题命中 软件智能体 :agent(abstract);multi-agent(abstract);分类 cs.SE

AI总结 本文通过分析真实用户-大语言模型交互数据,揭示多轮协作代码生成中的交互恶臭现象,提出InCE框架以提升交互质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27646 2026-03-31 cs.CL hep-lat hep-ph physics.comp-ph physics.optics 70%

PRBench: End-to-end Paper Reproduction in Physics Research

PRBench: 物理研究中的端到端论文复现

Shi Qiu, Junyi Deng, Yiwei Deng, Haoran Dong, Jieyu Fu, Mao Li, Zeyu Li, Zhaolong Zhang, Huiwen Zheng, Leidong Bao, Anqi Lv, Zihan Mo, Yadi Niu, Yiyang Peng, Yu Tian, Yili Wang, Ziyu Wang, Zi-Yu Wang, Jiashen Wei, Liuheng Wu, Aoran Xue, Leyi Yang, Guanglu Yuan, Xiarui Zhan, Jingjun Zhang, Zifan Zheng, Pengfei Liu, Linrui Zhen, Kaiyang Li, Qichang Li, Ziheng Zhou, Guo-En Nian, Yunwei Xiao, Qing-Hong Cao, Linjie Dai, Xu Feng, Peng Gao, Ying Gu, Chang Liu, Jia Liu, Ming-xing Luo, Yan-Qing Ma, Liang-You Peng, Huichao Song, Shufeng Wang, Chenxu Wang, Tao Wang, Yi-Nan Wang, Chengyin Wu, Pengwei Zhao, Hua Xing Zhu

机构 * School of Physics, Peking University(北京大学物理学院) Beijing Computational Science Research Center(北京计算科学研究中心)

专题命中 软件智能体 :agent(abstract);AI agent(abstract);分类 cs.CL

AI总结 PRBench通过30个物理领域专家任务评估AI在复现科学论文中的能力,发现现有模型在数据准确性和代码正确性上表现不佳,揭示了系统性失败模式。

Comments 17 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08492 2026-03-31 cs.AI 70%

Autonomous Issue Resolver: Towards Zero-Touch Code Maintenance

自主问题解决者:迈向零接触代码维护

Aliaksei Kaliutau

机构 * Imperial College London(伦敦帝国理工学院)

专题命中 软件智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文提出基于数据转换图的新型方法,通过数据状态节点和函数边的拓扑结构,解决传统代码属性图的控制流逻辑缺陷,实现数据完整性导航与控制流逻辑的统一,提升代码修复效率。

Comments 21 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26942 2026-03-31 cs.HC 69%

The Observability Gap: Why Output-Level Human Feedback Fails for LLM Coding Agents

可观性缺口:为何输出级人类反馈在LLM编码代理中失效

Yinghao Wang, Cheng Wang

专题命中 软件智能体 :agent(abstract,comments);multi-agent(abstract)

AI总结 研究发现,LLM编码代理在缺乏预定义功能的情况下,通过轻量级人类反馈构建可重用函数库时,输出反馈无法有效识别根因,导致持续失败模式。

Comments Accepted to CHI 2026 Workshop on Human-Agent Collaboration

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28309 2026-03-31 cs.CR 67%

VulnScout-C: A Lightweight Transformer for C Code Vulnerability Detection

VulnScout-C:一种轻量级的Transformer用于C代码漏洞检测

Aymen Lassoued, Nacef Mbarek, Bechir Dardouri, Bassem Ouni, Qing Li, Fakhri Karray

专题命中 软件智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文提出VulnScout-C,一种轻量级Transformer模型,用于C代码漏洞检测,同时构建了VulnScout数据集,实验表明其在检测性能上优于现有方法,且具有更低的推理成本。

Comments Submitted to IEEE Transactions on Dependable and Secure Computing

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27880 2026-03-31 cs.LG cs.AI cs.RO math.DS 62%

Kernel Dynamics under Path Entropy Maximization

核动力学在路径熵最大化下

Jnaneshwar Das

机构 * Earth Innovation Hub(地球创新中心)

专题命中 软件智能体 :agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出一个变分框架,将核函数视为路径熵最大化下的动态变量,探讨核函数的表示结构与信息几何分析,提出固定点条件、RG流及NTK演化的候选实例,并基于信息热力学假设推导核变化的下界。

Comments 7 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20404 2026-03-31 cs.SE cs.AI cs.ET cs.HC 62%

On the Impact of AGENTS.md Files on the Efficiency of AI Coding Agents

关于AGENTS.md文件对AI编码代理效率的影响

Jai Lal Lulla, Seyedmoein Mohsenimofidi, Matthias Galster, Jie M. Zhang, Sebastian Baltes, Christoph Treude

机构 * Singapore Management University(新加坡管理大学) Heidelberg University(海德堡大学) University of Bamberg(班贝格大学) King's College London(伦敦国王学院)

专题命中 软件智能体 :agent(abstract);分类 cs.AI、cs.SE

AI总结 研究AGENTS.md文件对AI编码代理在GitHub拉取请求上的运行效率和令牌消耗的影响,发现其能降低运行时间及令牌消耗,同时保持任务完成行为。

Comments 5 pages, 1 figure, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏