arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 6842 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工作流自动化 862 篇

2606.12432 2026-06-12 cs.CY cs.HC 新提交 50%

AI Debris: Residual Risk and the Afterlife of Failed AI Systems

AI 残骸:失败 AI 系统的残余风险与后续影响

Victor Frimpong

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出“AI 残骸”概念,指退役 AI 系统产生的残余风险,并开发了包含五个领域的分类法和 AI 残骸退役协议(AIDP),以帮助监管机构、审计师和组织加强 AI 生命周期治理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13291 2026-06-12 astro-ph.SR 新提交 50%

Automatic detection of Flare Ribbon Fine Structures as Proxies for Plasmoid Dynamics in Flare Reconnection

耀斑带精细结构的自动检测作为耀斑重联中等离子体团动力学的代理

Georgios Chouliaras, Peter F. Wyper, Joel T. Dahlin, Lyndsay Fletcher

专题命中 工作流自动化 :workflow(abstract)

AI总结 提出一种自动检测耀斑带前沿螺旋和波状结构的方法,应用于高分辨率3D爆发耀斑模拟的磁力线长度图,发现这些特征与等离子体团介导的间歇性重联相关。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12236 2026-06-12 cs.RO cs.CV 新提交 50%

DrivingAgent: Design and Scheduling Agents for Autonomous Driving Systems

DrivingAgent: 自动驾驶系统的设计与调度智能体

Zhongyu Xia, Wenhao Chen, Yongtao Wang, Ming-Hsuan Yang

机构 * Wangxuan Institute of Computer Technology, Peking University(北京大学王选计算机技术研究所) University of California, Merced(加州大学默塞德分校)

专题命中 工作流自动化 :agent(abstract)

AI总结 提出DrivingAgent框架,通过自动化模块开发(设计阶段)和强化学习训练的轻量级LLM实时调度(调度阶段),解决自动驾驶系统集成新模型和满足实时约束的挑战,在nuScenes和Bench2Drive上取得更优速度-精度权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12317 2026-06-11 stat.ME stat.CO 新提交 50%

ShrinkageTrees: An R Package for Bayesian Tree Ensembles for Survival Analysis and Causal Inference

ShrinkageTrees: 用于生存分析和因果推断的贝叶斯树集成R包

Tijn Jacobs

专题命中 工作流自动化 :workflow(abstract)

AI总结 ShrinkageTrees是一个R包,通过贝叶斯加性回归树模型处理右删失和区间删失生存数据,支持因果推断中的预后和治疗效应分解,并引入深度惩罚、Dirichlet分裂和马蹄铁先验等正则化策略,适用于高维场景。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11419 2026-06-11 cs.RO 新提交 50%

A Modular Dual-Camera Pipeline for Micro-Inspection Using Aerial Robots

一种用于空中机器人微检测的模块化双相机流水线

S. H. Mirtajadini, N. Rublein, R. M. Ramakrishnan, G. ter Maat, M. Aldibaja, A. Y. Mersha

机构 * Netherlands Organization for Scientific Research (NWO)(荷兰科学研究组织) Saxion University of Applied Sciences(萨克逊应用科学大学)

专题命中 工作流自动化 :planning(abstract)

AI总结 提出一种模块化双相机空中微检测流水线,通过变焦云台相机和广角立体导航相机协同工作,结合视觉反馈回路,实现对树木和温室粘虫板等非结构目标的鲁棒微检测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12157 2026-06-11 physics.comp-ph physics.data-an physics.ins-det 新提交 50%

fitPALSpectra: Python fitting of positron annihilation lifetime spectra

fitPALSpectra: 正电子湮灭寿命谱的Python拟合

Georgios E. Pavlou

专题命中 工作流自动化 :workflow(abstract)

AI总结 提出开源Python工作流fitPALSpectra,通过解析积分指数-高斯响应模型、约束优化和最小二乘精化,实现可配置的PALS谱模拟、拟合、可视化和报告,在合成谱上准确恢复寿命、强度等参数。

Comments 6 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12083 2026-06-11 cond-mat.mtrl-sci physics.app-ph physics.comp-ph physics.optics 新提交 50%

Multilayer Screening of Double and Conventional Perovskite Solar Cells Using SCAPS-1D and Machine Learning: Optimization of ETL, HTL, and Absorber for High-Efficiency Architectures

基于SCAPS-1D和机器学习的双层与常规钙钛矿太阳能电池多层筛选:面向高效架构的ETL、HTL和吸收层优化

Neda Nasiri, Seyed Mahdi Mastoor, Amirhosein Ahmadkhan Kordbacheh

专题命中 工作流自动化 :workflow(abstract)

AI总结 结合SCAPS-1D模拟与机器学习,系统筛选125种多层钙钛矿电池结构,发现Cs2AgInBr6基无铅双钙钛矿器件效率达28.62%,SHAP分析揭示HTL带隙等关键参数。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10873 2026-06-10 q-bio.QM 新提交 50%

Spatial Model Selection and Uncertainty Quantification: Comparing Continuous and Discrete Wound Healing Models

空间模型选择与不确定性量化:连续与离散伤口愈合模型的比较

John T. Nardini, Jana L. Gevertz

专题命中 工作流自动化 :agent(abstract)

AI总结 针对空间过程建模中偏微分方程与基于智能体模型的选择问题,提出基于近似贝叶斯计算的模型选择流程,发现平均场PDE在计算速度和模型选择上优于ABM,并应用于伤口愈合数据。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10350 2026-06-10 cs.CV 新提交 50%

Multi-Angular Reflectance Anisotropy Observed from UAV Multispectral Imagery

无人机多光谱影像观测的多角度反射率各向异性

Zhenqiang Qin, Chenguang Dai, Min Wang, Xian Li

机构 * University of Information Engineering(信息工程大学)

专题命中 工作流自动化 :workflow(abstract)

AI总结 提出一种几何感知的多角度观测提取流程,从BRDF角度量化观测几何效应,通过SFM精化相机参数并重投影同质区域,联合提取多波段反射率和观测几何参数,发现红边和近红外波段反射率变化达119-137%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10031 2026-06-10 cs.CR 新提交 50%

The Chronicles of Radio Frequency Fingerprinting

射频指纹编年史

Abdul Aziz, Ingrid Huso, Savio Sciancalepore, Gabriele Oligeri

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文回顾射频指纹(RFF)从1993年至2026年的发展历程,分析其范式转变,包括瞬态方法、稳态特征、机器学习和深度学习阶段,并指出信道依赖、跨域泛化等关键挑战。

Comments 12 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10992 2026-06-10 physics.geo-ph 新提交 50%

Surface Crevasse Evolution Observed Using Matched Field Processing and Source Relocation at Hansbreen, Svalbard

基于匹配场处理与源重定位观测的斯瓦尔巴群岛汉斯冰川表面冰裂缝演化

Wojciech Gajek, Ugo Nanni, Ali Gholami, William D. Harcourt, Danni M. Pearce, Louise Steffensen Schmidt

专题命中 工作流自动化 :workflow(abstract)

AI总结 提出结合匹配场处理与离散到时重定位的两步法,在有限仪器条件下实现米级分辨率冰川地震活动定位,揭示汉斯冰川表面冰裂缝传播速率与扩散系数。

Comments An edited version of this paper was published by AGU. Published 2026 American Geophysical Union. For supplementary materials please contact the authors. Citation will be added

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11064 2026-06-10 physics.chem-ph cond-mat.dis-nn cond-mat.mtrl-sci cond-mat.str-el physics.comp-ph 新提交 50%

The UZH protocol: Separating errors and constructing improved CP2K basis sets and pseudopotentials

UZH协议:分离误差并构建改进的CP2K基组和赝势

Hossein Mirhosseini, Tiziano M. A. Müller, Matthias Krack, Thomas D. Kühne, Jürg Hutter

专题命中 工作流自动化 :workflow(abstract)

AI总结 提出UZH协议,通过三路比较分解CP2K中的高斯基组和赝势误差,并优化参数文件,从而改进基组和赝势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10251 2026-06-10 cond-mat.mtrl-sci 新提交 50%

Robust AI-Driven Discovery of Electronic Metal Phosphide Semiconductors

鲁棒的人工智能驱动电子金属磷化物半导体发现

Benhao Zhu, Muhammad Faizan, Zewei Li, Wenshuo Li, Feifei Ren, Jiahao Xie, Lijun Zhang

专题命中 工作流自动化 :workflow(abstract)

AI总结 结合生成式材料设计、机器学习原子间势和密度泛函理论,高通量筛选出3574种稳定磷化物,包括196种半导体,并识别出30种光电和26种热电候选材料。

Comments 46 pages, 5 main figures; Supporting Information included

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09600 2026-06-09 cs.IT math.IT 新提交 50%

Formal Foundations and Proof-Carrying Certificates for q-ary Covering Codes in Lean 4

q元覆盖码的形式化基础与携带证明的证书在Lean 4中

Andreas Florath

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文在Lean 4中形式化了q元覆盖码的基础理论,包括汉明球体积公式、球覆盖下界等,并展示了端到端的工作流程以验证显式上界,贡献了一个可重用、可审计的机器校验覆盖码证书基础。

Comments 20 pages, no figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08515 2026-06-09 cs.DC 新提交 50%

Unifying von-Neumann HPC and Neuromorphic Acceleration via the EBRAINS Research Infrastructure: A Framework for High-Performance Workflows

通过EBRAINS研究基础设施统一冯·诺伊曼HPC与神经形态加速:高性能工作流框架

Krishna Kant Singh, Charl Linssen, Eric Müller, Eleni Mathioulaki, Wouter Klijn, Lena Oden

专题命中 工作流自动化 :workflow(abstract)

AI总结 提出基于EBRAINS JupyterLab的统一云工作流,支持用户透明地在冯·诺伊曼超算和神经形态硬件上执行脉冲神经网络,通过容器化和领域特定语言实现跨平台可重复性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06702 2026-06-08 cs.HC 新提交 50%

Adversarial Co-Thinking: Calibration and Triangulation Across Multiple GenAI Tools in HCI Writing

对抗性协同思考:HCI写作中多种GenAI工具的校准与三角验证

Pia Tukkinen

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文探讨在学术论文起草阶段完全嵌入GenAI工具(Claude、ChatGPT、Gemini)的协作写作模式,提出“对抗性协同思考”方法:利用过往同行评审校准工具,并让工具输出相互对抗以测试而非盲从,强调评估能力而非生成能力是关键技能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07278 2026-06-08 physics.ins-det hep-ex 新提交 50%

Sensor Quality Control and Annealing Studies of HGCAL Silicon Sensors

HGCAL硅传感器的质量控制与退火研究

Gizem Gul Dincer

专题命中 工作流自动化 :workflow(abstract)

AI总结 总结CMS HGCAL探测器未辐照硅传感器的质量控制结果,并首次对暴露于2×10¹⁵ n_eq/cm²的120μm外延传感器进行详细退火研究,提取Hamburg模型参数。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 软件智能体 497 篇

2606.15874 2026-06-23 cs.AI cs.SE 新提交 93%

LLM-as-Code: Agentic Programming for Agent Harness

LLM即代码:面向Agent框架的编程范式

Junjia Qi, Zichuan Fu, Jingtong Gao, Wenlin Zhang, Hanyu Yan, Xian Wu, Xiangyu Zhao

机构 * City University of Hong Kong(香港城市大学) Tencent Jarvis Lab(腾讯贾维斯实验室)

专题命中 软件智能体 :agentic(title,summary_cn);agent(title,title_cn);分类 cs.AI、cs.SE

AI总结 针对LLM作为编排器导致控制流幻觉和不可靠执行的问题,提出Agentic Programming范式,由程序控制所有流程,LLM仅作为代码组件在需要推理或生成时被调用,显著提升长序列操作的稳定性。

Comments Accepted at the KDD 2026 Workshop on Agentic Software Engineering (AgenticSE)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13900 2026-08-17 cs.DB cs.AI cs.CL cs.LG 新提交 91%

Agentic Transaction: Towards ACID-Compliant Agent Systems

智能体事务:面向ACID兼容的智能体系统

Zhaoyan Sun, Xiaoxiao Wang, Guoliang Li

专题命中 软件智能体 :agent(title,abstract);agentic(title,abstract);AI agent(abstract);tool use(abstract)

AI总结 该研究提出ACID兼容的智能体事务框架,开发对应数据智能体,在基准测试中较含Claude Code的现有智能体提升10.6%,为构建可信可扩展AI智能体开辟新方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27386 2026-06-29 cs.DL cs.AI 新提交 91%

Agentic Publication Protocol: An Attempt to Modernize Scientific Publication

Agentic Publication Protocol:科学出版现代化的一次尝试

Sirui Lu, Xiao-Liang Qi

机构 * Max-Planck-Institut für Quantenoptik(马克斯·普朗克量子光学研究所) Munich Center for Quantum Science and Technology(慕尼黑量子科学与技术中心) Leinweber Institute for Theoretical Physics(莱因韦伯理论物理研究所)

专题命中 软件智能体 :agentic(title,title_cn);agent(abstract);分类 cs.AI

AI总结 提出Agentic Publication Protocol(APP),一种将论文与代码、数据、环境信息及智能体指令打包的轻量级仓库格式,使未来研究者能直接使用操作知识。

Comments 16 pages, 5 figures and 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11537 2026-06-19 cs.AI cs.CE 新提交 91%

MoCA-Agent: A Market-of-Claims Code Agent for Financial and Numerical Reasoning

MoCA-Agent: 一种用于金融和数值推理的声明市场代码智能体

Abdelrahman Abdallah, AbdelRahim A. Elmadany, Sameh Al Natour, Hasan Cavusoglu, Adam Jatowt, Muhammad Abdul-Mageed

机构 * University of Innsbruck(因斯布鲁克大学) University of British Columbia(不列颠哥伦比亚大学) Toronto Metropolitan University(多伦多都会大学)

专题命中 软件智能体 :agent(title,title_cn);multi-agent(abstract);分类 cs.AI

AI总结 提出MoCA-Agent,通过声明级验证和代码生成解决金融表格问答中的数值推理错误,在十个基准上取得强性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16742 2026-08-18 cs.SE cs.AI 新提交 90%

TDD-Agent: Test-Driven Reasoning for Code Generation

TDD-Agent:用于代码生成的测试驱动推理

Hongyue Yu, Kefan Li, Jiakun Li, Hongzheng Chai, Yuan Yuan, Rui He, Junyi Wei

专题命中 软件智能体 :agent(title,title_cn);分类 cs.AI、cs.SE

AI总结 TDD-Agent将测试驱动开发范式应用于代码生成,通过测试优先推理和迭代双轨优化,在LiveCodeBench和RepoEval上均优于相关基线,提升了代码及测试的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17454 2026-06-18 cs.AI cs.LG 新提交 90%

Dissecting model behavior through agent trajectories

通过智能体轨迹剖析模型行为

Gaurav Gupta, Vatshank Chaturvedi, Jun Huan, Anoop Deoras

机构 * AWS AI Labs(AWS人工智能实验室)

专题命中 软件智能体 :agent(title,summary_cn);AI agent(abstract);agentic(abstract);分类 cs.AI、cs.LG

AI总结 本文提出“意图-执行差距”概念,并设计Simple Strands Agent(SSA)框架,通过分析138k条轨迹揭示模型在自主问题解决中的行为差异。

Comments 106 pages, 50 Figures, 16 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14589 2026-06-15 cs.SE cs.AI cs.DC 新提交 90%

When Errors Become Narratives: A Longitudinal Taxonomy of Silent Failures in a Production LLM Agent Runtime

当错误成为叙事:生产级LLM Agent运行时中静默故障的纵向分类

Wei Wu

机构 * Independent researcher(独立研究者)

专题命中 软件智能体 :agent(title,title_cn);分类 cs.AI、cs.SE

AI总结 通过八周对生产级个人助手Agent运行时的研究,识别出28次静默故障,提出五类机制导向分类,其中D类(链式幻觉与捏造)为LLM特有且最危险,系统会生成流畅可信的虚假叙事。

Comments 18 pages, 5 figures, 2 tables. 22 incident postmortems and all defense-framework artifacts publicly available at https://github.com/bisdom-cell/openclaw-model-bridge; governance engine on PyPI (openclaw-ontology-engine)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01456 2026-07-03 cs.SE 新提交 90%

From Anatomy to Smells: An Empirical Study of SKILL.md in Agent Skills

从解剖到气味:Agent技能中SKILL.md的实证研究

David Boram Hong, Aaron Imani, Iftekhar Ahmed

专题命中 软件智能体 :agent(title,title_cn);分类 cs.SE

AI总结 对238个真实Agent技能的SKILL.md文件进行定性分析,构建语义组件分类法,通过多源文献综述识别最佳实践并定义技能气味,开发自动检测器发现超过99%的文件存在气味且难以消除。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15678 2026-08-18 cs.SE 新提交 89%

Where Accountability Lives: Mapping Human Responsibility to Workflow Artifacts in Agentic Software Development

责任归属:在智能体软件开发中将人类责任映射到工作流制品

Sabry E. Farrag

专题命中 软件智能体 :workflow(title,abstract);agentic(title,abstract);agent(abstract);分类 cs.SE

AI总结 该研究分析智能体软件开发中责任归属的矛盾,替换验证分类法,发现责任归属方向相反,指出智能体工具未造成责任差距,相关数据已公开。

Comments 30 pages, 5 tables. Source collection of 118 archived documents and 12 processing scripts deposited at Zenodo, doi:10.5281/zenodo.21965182

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13884 2026-08-17 cs.SE cs.AI cs.ET cs.HC cs.LG 新提交 89%

Engineering Signals of Human-AI Collaboration in the Agentic Coding Era: A Longitudinal Analysis of 33,228 Pull Requests from vLLM and SGLang with Implications for Biomedical AI Agents and Bioinformatics Pipeline Developmen

智能体编码时代人机协作的工程信号:对vLLM和SGLang中33228个拉取请求的纵向分析及其对生物医学智能体和生物信息学流程开发的启示

Jiada Li, Xuesong Ye, Olamide Olowoniyi

专题命中 软件智能体 :agentic(title,abstract);AI agent(title);autonomous agent(abstract);分类 cs.AI、cs.LG、cs.SE

AI总结 该研究对vLLM和SGLang的33228个拉取请求进行纵向分析,发现AI辅助开发提升了开源软件的吞吐量、贡献者参与度及人机协作信号,且增长主要由人类驱动,为生物医学智能体开发提供启示。

Comments 24 pages, 9 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21495 2026-07-24 cs.AI cs.ET cs.MA 新提交 88%

Toward Continuous Assurance for the Democratization of AI Agent Creation in Industry

迈向工业中人工智能代理创建民主化的持续保障

Natan Levy, Harel Berger

专题命中 软件智能体 :agent(title,abstract);AI agent(title,abstract);分类 cs.AI

AI总结 针对工业中人工智能代理创建民主化带来的可靠性挑战,提出轻量级持续保障框架,结合依赖映射等多种方法评估代理运行状态,还展示了原型审核器及评估,为公民创建的组织代理提供保障。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04697 2026-07-08 cs.SE 新提交 88%

AI Agent Pull Requests on GitHub: Frequency, Structure, and Merge Conflict Rates

GitHub上的AI代理拉取请求:频率、结构和合并冲突率

George Xu, Arjun Subramanian, Nithilan Karthik

专题命中 软件智能体 :agent(title,abstract);AI agent(title,abstract);分类 cs.SE

AI总结 利用AIDev-pop数据集对AI代理编写的拉取请求并发情况进行大规模实证分析,发现特定时间重叠下部分仓库有协同活动的请求对,多数为同一代理,还研究了合并冲突率及冲突类型。

Comments 7 pages, 4 figures, 2 tables. Replication package: https://doi.org/10.5281/zenodo.21186464

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05120 2026-07-07 cs.CR cs.AI 新提交 88%

Agent Data Injection Attacks are Realistic Threats to AI Agents

智能体数据注入攻击对人工智能智能体构成现实威胁

Woohyuk Choi, Juhee Kim, Taehyun Kang, Jihyeon Jeong, Luyi Xing, Byoungyoung Lee

机构 * Seoul National University(首尔国立大学) Largosoft University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 软件智能体 :agent(title,abstract);AI agent(title,abstract);分类 cs.AI

AI总结 介绍智能体数据注入攻击(ADI)这一新型间接提示注入,其伪装可信数据注入恶意数据使智能体执行意外操作,研究发现现实智能体漏洞及ADI在多种模型和智能体设置中有效,揭示智能体安全关键差距。

Comments 19 pages, 19 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏