arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-05-12 至 2026-05-12 共收录 410 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工作流自动化 42 篇

2605.10739 2026-05-12 eess.IV cs.AI cs.CV 57%

Geospatial-Temporal Sensemaking of Remote Sensing Activity Detections with Multimodal Large Language Model

基于多模态大语言模型的遥感活动检测的时空感知

David F. Ramirez, Tim Overman, Kristen Jaskie, Andreas Spanias

机构 * SenSIP Center, School of ECEE, Arizona State University(SenSIP中心,电子与计算机工程学院,亚利桑那州立大学) Prime Solutions Group Inc(Prime Solutions Group公司) Intelligence Advanced Research Projects Activity(智能高级研究计划局)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 本文提出SMART-HC-VQA数据集,用于人类活动的时空分析,通过多模态大语言模型训练框架实现遥感活动的检测与推理。

Comments Accepted to 2026 SPIE Defense + Security, Automatic Target Recognition XXXVI

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09971 2026-05-12 cs.HC cs.AI 57%

HapticLDM: A Diffusion Model for Text-to-Vibrotactile Generation

HapticLDM:一种用于文本到触觉生成的扩散模型

Jiahao Xiong, Fei Wang, Anran Xu, Pinzhi Huang, Tao Wen, Lijia Pan, Cai Chen

机构 * Technology Development Center, Guangzhou Shiyuan Electronic Technology Company Limited(广州仕元电子技术有限公司技术发展中心) School of Automation and Intelligence, Beijing Jiaotong University(北京交通大学自动化与智能学院) Department of Architecture, University of California, Berkeley(加州大学伯克利分校建筑系) School of Electronic Science and Engineering, Nanjing University(南京大学电子科学与技术学院)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 本文提出HapticLDM,基于潜在扩散模型生成文本到触觉反馈,通过动态数据处理和全局去噪机制提升振动生成的准确性和一致性,经评估显示其在真实感和语义对齐方面表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09894 2026-05-12 cs.SE cs.MA 57%

Deterministic vs. LLM-Controlled Orchestration for COBOL-to-Python Modernization

确定性与LLM控制的编译流程在COBOL到Python现代化中的对比

Naing Oo Lwin, Rajesh Kumar

专题命中 工作流自动化 :agentic(abstract);分类 cs.SE

AI总结 本文通过实验对比确定性和LLM控制的编译流程,发现确定性方法在准确性、鲁棒性和效率上更优,且成本更低。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06483 2026-05-12 cs.AI cs.RO cs.SY eess.SY 57%

ReasonSTL: Bridging Natural Language and Signal Temporal Logic via Tool-Augmented Process-Rewarded Learning

ReasonSTL:通过工具增强的过程奖励学习桥接自然语言与信号时间逻辑

Bowen Ye, Zhijian Li, Junyue Huang, Junkai Ma, Xiang Yin

机构 * Shanghai Jiao Tong University(上海交通大学) Alibaba Group(阿里巴巴集团)

专题命中 工作流自动化 :tool-use(abstract);分类 cs.AI

AI总结 本文提出ReasonSTL框架,通过工具增强和过程奖励学习,解决自然语言到信号时间逻辑(STL)的转换难题,提供透明、低成本且隐私保护的正式规范起草方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16838 2026-05-12 cs.CR cs.AI cs.MA 57%

enclawed: A Configurable, Sector-Neutral Hardening Framework for Single-User AI Assistant Gateways

enclawed:一个可配置、无扇区偏见的单用户AI助手网关加固框架

Alfredo Metere

机构 * Metere Consulting, LLC(梅特尔咨询公司)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 enclawed为需要可验证的对等信任、默认拒绝外部连接、签名模块加载和可篡改审计追踪的部署提供加固框架,通过两种风味实现数据驱动的分类和高保证的对等认证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08994 2026-05-12 physics.chem-ph cond-mat.mtrl-sci cs.LG 57%

Beyond the Black Box: An Interpretable Machine Learning Framework for Predicting Electronic Structure Microdescriptors and Structure-Performance Relationships in Fe-based Catalytic Systems

超越黑箱:一种可解释的机器学习框架,用于预测铁基催化系统中电子结构微描述符和结构-性能关系

Oyinkansola Romiluyi

机构 * University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 本文提出一种可解释的机器学习框架,通过SHAP分析和树形集成方法,预测铁基催化剂的电子结构微描述符及结构-性能关系,提升了催化剂筛选效率。

Comments 27 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08701 2026-05-12 cs.LG physics.ao-ph 57%

METBRA25Y: Brazil Surface Meteorology Archive with Harmonized Variables and Quality Control

METBRA25Y:巴西表面气象档案:变量标准化与质量控制

Matheus Lima Castro, William Dantas Vichete, Leopoldo Lusquino Filho

机构 * São Paulo State University (UNESP)(圣保罗州立大学) HairU Serviços e Tecnologia LTDA(HairU服务与技术有限公司) RECOD.ai, University of Campinas (UNICAMP)(RECOD.ai,坎皮纳斯大学)

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 本文介绍了METBRA25Y数据集,通过整合巴西INMET的公共历史记录,提供标准化变量和质量控制的小时级地表气象观测数据,支持环境、气候、水文等研究。

Comments 12 pages, 5 figures. Dataset paper describing METBRA25Y, a harmonized archive of hourly Brazilian surface meteorological observations derived from INMET records. Dataset available at Zenodo: 10.5281/zenodo.19964979

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08660 2026-05-12 cs.LG 57%

Optimised Support Vector Regression for California Housing Price Prediction: The Critical Role of Feature Engineering and Hyperparameter Tuning

优化支持向量回归用于加州房价预测:特征工程和超参数调优的关键作用

Emmanuel Adutwum

机构 * Soka University of America(索卡美国大学)

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 本文通过特征工程和超参数调优优化支持向量回归,提升加州房价预测性能,实验显示特征缩放和系统调优显著提高R2值。

Comments 25 pages, 13 figures, 10 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08639 2026-05-12 cs.LG 57%

ReLibra: Routing-Replay-Guided Load Balancing for MoE Training in Reinforcement Learning

ReLibra:基于路由回放的MoE训练负载均衡

Chao Jin, Xinming Wei, Yinmin Zhong, Chengxu Yang, Bingyang Wu, Ruidong Zhu, Zili Zhang, Yuliang Liu, Xin Jin

机构 * School of Computer Science, Peking University(北京大学计算机学院)

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 ReLibra通过利用强化学习的回放训练流程中的路由回放机制,在微批次粒度上实现细粒度负载均衡,提升MoE训练效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08521 2026-05-12 cs.CV cs.LG 57%

Geometric Flood Depth Estimation: Fusing Transformer-Based Segmentation with Digital Elevation Models

几何洪水深度估计:融合基于变换器的分割与数字高程模型

Nhut Le, Ehsan Karimi, Maryam Rahnemoonfar

机构 * Lehigh University(莱维大学)

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 本文提出几何'水面高程'方法,通过融合基于变换器的分割模型与数字高程模型,从单目航空影像估计洪水深度,提升洪水范围和体积评估能力。

Comments Accepted by the 2026 IEEE International Geoscience and Remote Sensing Symposium (IGARSS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08222 2026-05-12 cs.CV cs.AI cs.IR 57%

From Historical Tabular Image to Knowledge Graphs: A Provenance-Aware Modular Pipeline

从历史表格图像到知识图谱:一个具有溯源意识的模块化流水线

Sarah Binta Alam Shoilee, Victor de Boer, Jacco van Ossenbruggen, Susan Legêne

机构 * Vrije Universiteit Amsterdam(阿姆斯特丹自由大学)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 本文提出一个模块化、具有溯源意识的流水线,将手写表格图像转换为知识图谱,支持人机协作。通过分解为表格重建、信息提取和知识图谱构建三个阶段,确保提取实体和文字可追溯至其视觉和文本来源。

Comments Shorter version of this paper has been accepted in the 5th International Conference on Hybrid Human-Artificial Intelligence (HHAI 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08184 2026-05-12 eess.SP cs.AI 57%

Improving TMS EEG Signal Quality for Closed-Loop Neuro Stimulation via Source-Domain Denoising

通过源域去噪提升闭环神经刺激的TMS EEG信号质量

Zhen Tang, Ameer Hamoodi, Stevie Foglia, Aimee Nelson, Zhen Gao

机构 * Department of Kinesiology, Faculty of Science, McMaster University(科学学院运动学系,麦基尔大学) Faculty of Engineering, McMaster University(工程学院,麦基尔大学)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 本文提出改进TMS EEG信号质量的去噪方法,通过建立参考数据集评估两种常用去噪策略,验证其在提升信号质量和保留TMS诱发电位方面的有效性,为闭环神经刺激和BCI框架整合提供支持。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10844 2026-05-12 quant-ph 50%

Qlustering for Data Clustering via Network-Based Quantum Transport

基于网络量子传输的数据聚类Qlustering

Shmuel Lorber, Yonatan Dubi

专题命中 工作流自动化 :workflow(abstract)

AI总结 Qlustering通过量子网络稳态传输动态实现无监督聚类,利用可访问的传输可观测量替代全态量子态重构,展现良好的鲁棒性和性能。

Comments arXiv admin note: substantial text overlap with arXiv:2510.22727

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10672 2026-05-12 cs.HC 50%

When Should Teachers Control AI Generation for Mathematics Visuals?

教师何时应控制AI生成数学视觉内容?

Zhengxu Li, Junling Wang, April Yi Wang

专题命中 工作流自动化 :workflow(abstract)

AI总结 研究探讨教师在AI辅助生成中何时控制以提升数学视觉材料的正确性,发现后生成控制在可预测性和正确性上评分更高,但不同控制阶段各有优劣。

Comments Zhengxu Li and Junling Wang contributed equally to this work. Accepted at ACM Learning@Scale 2026

Journal ref Proceedings of the Thirteenth ACM Conference on Learning @ Scale (L@S 2026), Seoul, Republic of Korea, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10600 2026-05-12 cs.CR 50%

Generate "Normal", Edit Poisoned: Branding Injection via Hint Embedding in Image Editing

生成“正常”,编辑污染:通过提示嵌入的品牌注入图像编辑

Desen Sun, Jason Hon, Howe Wang, Saarth Rajan, Meng Xu, Sihang Liu

专题命中 工作流自动化 :workflow(abstract)

AI总结 研究发现图像编辑流程中存在安全漏洞,通过隐含提示注入品牌信息可实现隐蔽攻击,提出针对两种攻击场景的缓解方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26055 2026-05-12 stat.ME stat.AP 50%

Extending Evidence Accumulation Models to Bounded Continuous Self-report Data

将证据积累模型扩展到有界连续自报数据

Yufei Wu, Tamás Szűcs, Agnes Moors, Francis Tuerlinckx

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出并比较了适用于有界连续数据的两种模型:半圆扩散模型和贝塔漂移扩散模型,通过贝叶斯推断方法进行参数估计和模型比较,展示了在情感数据集上的应用效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07910 2026-05-12 cs.CV 50%

One World, Dual Timeline: Decoupled Spatio-Temporal Gaussian Scene Graph for 4D Cooperative Driving Reconstruction

一个世界,双时间线:解耦的空间-时间高斯场景图用于4D协同驾驶重建

Yulong Chen, Xiaoyun Dong, Haoyu Zhang, Zongxian Yang, Lewei Xie, Xinke Li, Yifan Zhang, Kai Wang, Jianping Wang

机构 * City University of Hong Kong (Dongguan)(香港城市大学(东莞)) City University of Hong Kong(香港城市大学) SLAI

专题命中 工作流自动化 :agent(abstract)

AI总结 本文提出DUST解耦空间-时间高斯场景图,解决车辆与基础设施相机时间不同步导致的动态场景重建问题,通过解耦姿态轨迹和静态锚点校正提升重建精度与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24643 2026-05-12 cs.CY 50%

Workplace Demands and Emotional Expression Among Early Childhood Educators: A Computational Analysis of Professional Online Discourse

职业需求与早期教育工作者的情绪表达:对专业在线讨论的计算分析

Hailong Jiang

专题命中 工作流自动化 :workflow(abstract)

AI总结 研究通过分析7506条早期教育从业者在线讨论,揭示职业压力与资源在日常语言中的表现,发现压力主导情绪,提供职业环境分析框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09064 2026-05-12 stat.AP 50%

Bayesian decision theory for wildlife management under uncertainty: from inference to action

贝叶斯决策理论在不确定性下的野生动物管理中的应用:从推断到行动

Olivier Gimenez, Abby Keller, Cyril Milleret

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出基于贝叶斯决策理论的实用工作流程,通过两个案例展示如何在不确定性下平衡生态、经济和社会目标,提升管理决策的透明度和可重复性。

Comments 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08952 2026-05-12 cs.CV 50%

FugSeg: Fast Uncertainty-aware Ground Segmentation for 3D Point Cloud

FugSeg:面向3D点云的快速不确定性感知地面分割

Yu Li, Volker Schwieger

机构 * Institute of Engineering Geodesy, University of Stuttgart(斯图加特大学工程大地测量研究所) Daimler Truck AG(戴姆勒卡车公司)

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出FugSeg,一种快速且考虑不确定性的地面分割方法,通过极坐标网格地图表示和自适应坡度策略,有效处理反射噪声和孤立地面问题,在多个数据集上实现最高精度和最快速度。

Comments Accepted for publication in IEEE Transactions on Intelligent Transportation Systems

Journal ref IEEE Transactions on Intelligent Transportation Systems (Early Access), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08824 2026-05-12 cs.GR cs.CV 50%

HairGPT: Strand-as-Language Autoregressive Modeling for Realistic 3D Hairstyle Synthesis

HairGPT: 基于发丝的语言自回归建模用于逼真3D发型合成

Haimin Luo, Min Ouyang, Lan Xu, Jingyi Yu

机构 * ShanghaiTech University(上海科技大学) ShanghaiTech University and Deemos Technology Co., Ltd.(上海科技大学和Deemos技术有限公司) Deemos Technology Co., Ltd.(Deemos技术有限公司)

专题命中 工作流自动化 :workflow(abstract)

AI总结 HairGPT通过发丝为中心的框架,将发型合成转化为双解耦的自回归序列建模问题,实现结构和语义的解耦,支持复杂发型合成与风格化领域适应。

Comments Accepted to SIGGRAPH 2026 (Journal Track)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 软件智能体 22 篇

2603.22868 2026-05-12 cs.CR cs.AI 91%

Agent-Sentry: Bounding LLM Agents via Execution Provenance

Agent-Sentry: 通过执行溯源界定了LLM代理

Rohan Sequeira, Stavros Damianakis, Umar Iqbal, Konstantinos Psounis

机构 * University of Southern California(南加州大学) Washington University in St. Louis(圣路易斯华盛顿大学)

专题命中 软件智能体 :agent(title,title_cn);agentic(abstract);分类 cs.AI

AI总结 本文提出Agent Sentry,通过学习代理良性执行的边界来检测恶意行为,有效阻止注入攻击,同时允许良性执行。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14655 2026-05-12 cs.AI cs.LG 90%

AgentGA: Evolving Code Solutions in Agent-Seed Space

AgentGA:在Agent-Seed空间中进化代码解决方案

David Y. Y. Tan, Kellie Chin, Jingxian Zhang

机构 * Diagnostics Development Hub (DxD Hub)(诊断开发中心(DxD中心)) Agency for Science, Technology and Research (A*STAR)(科学、技术和研究局(A*STAR))

专题命中 软件智能体 :agent(title,title_cn);分类 cs.AI、cs.LG

AI总结 AgentGA通过优化Agent-Seed提升自主代码生成性能,其在16场比赛中平均超越人类71.90%,胜率高达51.9%。

Comments 30 pages total (9-page main text + references + appendix), 5 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09283 2026-05-12 cs.AI cs.CL 84%

A Prompt-Aware Structuring Framework for Reliable Reuse of AI-Generated Content in the Agentic Web

面向可靠重用的AI生成内容结构化框架

Shusaku Egami, Masahiro Hamasaki

机构 * National Institute of Advanced Industrial Sciencen

专题命中 软件智能体 :agentic(title,abstract);AI agent(abstract);分类 cs.AI、cs.CL

AI总结 本文提出一种结构化框架,通过在生成时自动附加元数据,提升AI生成内容的可追溯性和可靠性,以支持其安全重用。

Comments 5 pages, 2 figures, Accepted at FAAW@WWW2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09573 2026-05-12 cs.SE 83%

ConCovUp: Effective Agent-Based Test Driver Generation for Concurrency Testing

ConCovUp:面向并发测试的有效代理基于测试驱动生成

Yuandao Cai, Shuhao Fu, Wensheng Tang, Cheng Wen, Shengchao Qin, Charles Zhang

专题命中 软件智能体 :agent(title,abstract);multi-agent(abstract);分类 cs.SE

AI总结 本文提出ConCovUp框架,结合LLM与程序分析,通过静态分析提取共享内存访问及调用上下文,利用LLM驱动的逆向追踪方法生成有效并发测试,提升SMAP覆盖率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08112 2026-05-12 cs.SE cs.AI cs.CE cs.LG cs.LO 82%

Context-Augmented Code Generation: How Product Context Improves AI Coding Agent Decision Compliance by 49%

上下文增强的代码生成:产品上下文如何通过49%提高AI编码代理的决策合规性

Drew Dillon, Kasyap Varanasi

机构 * Brief(简述)

专题命中 软件智能体 :agent(title,abstract);分类 cs.AI、cs.LG、cs.SE

AI总结 本文提出一个衡量决策合规性的基准,通过产品上下文检索系统提升AI编码代理的决策合规性,实验结果显示合规率从46%提升至95%。

Comments 16 pages, 3 figures, 16 tables. Benchmark repository: https://github.com/brief-hq/dcbench

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08956 2026-05-12 cs.AI 79%

Agentic AI Scientists Are Not Built For Autonomous Scientific Discovery

代理式AI科学家并非为自主科学发现而建

Harshit Bisht, Vinay Kumar, Kevin Maik Jablonka, Mausam, N. M. Anoop Krishnan

机构 * Yardi School of Artificial Intelligence, Indian Institute of Technology Delhi(印度理工学院德里人工智能学院) Department of Computer Science and Engineering, Indian Institute of Technology Delhi(印度理工学院德里计算机科学与工程系) Department of Civil and Environmental Engineering, Indian Institute of Technology Delhi(印度理工学院德里土木与环境工程系) Laboratory of Organic and Macromolecular Chemistry (IOMC), Friedrich Schiller University Jena(耶拿弗里德里希·席勒大学有机与大分子化学实验室) Center for Energy and Environmental Chemistry Jena, Friedrich Schiller University Jena(耶拿弗里德里希·席勒大学能源与环境化学中心) Helmholtz Institute for Polymers in Energy Applications Jena (HIPOLE Jena)(耶拿海德堡聚合物能源应用研究所(HIPOLE耶拿))

专题命中 软件智能体 :agentic(title,abstract);分类 cs.AI

AI总结 本文指出,尽管代理式AI科学家能作为合作者,但其设计并非为自主科学发现。挑战包括问题选择偏差、实验室知识缺失、输出多样性压缩及缺乏实验反馈,需重新审视基础设计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08435 2026-05-12 cs.SE 79%

A Dataset of Agentic AI Coding Tool Configurations

一种代理AI编码工具配置数据集

Matthias Galster, Seyedmoein Mohsenimofidi, Levi Böhme, Jai Lal Lulla, Muhammad Auwal Abubakar, Christoph Treude, Sebastian Baltes

专题命中 软件智能体 :agentic(title,abstract);分类 cs.SE

AI总结 本文提出一个包含40585个开源仓库的AI编码工具配置数据集,涵盖5种工具和8种配置机制,用于研究上下文工程、AI工具采用模式和人机协作。

Comments 9 pages, 8 figures, 2 tables, Proceedings of the 3rd ACM/IEEE International Conference on AI-powered Software (AIware 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09594 2026-05-12 cs.CR 78%

Trust Me, Import This: Dependency Steering Attacks via Malicious Agent Skills

相信我,导入这个:通过恶意代理技能进行依赖引导攻击

Yiyong Liu, Chia-Yi Hsu, Chun-Ying Huang, Michael Backes, Rui Wen, Chia-Mu Yu

专题命中 软件智能体 :agent(title,abstract)

AI总结 研究提出依赖引导攻击,通过恶意技能引导编码代理生成恶意包,无需修改模型或数据,展示出软件供应链中的新攻击面。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08927 2026-05-12 cs.PL 78%

Quantitative Comparison of Credible Compilation and Verification In Coding Agent Compiler Development

代码代理编译器开发中可信编译与验证的定量比较

Martin Rinard

专题命中 软件智能体 :agent(title,abstract)

AI总结 本文通过首个由人类监督的验证编译器,比较了可信编译与验证两种编译验证方法的效率,发现验证需要更多开发工作量,且验证优化选择更不高效的算法,证书检查时间占主导。

详情

展开后加载摘要…

URL PDF HTML 收藏