arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-08-11 至 2026-08-11 共收录 440 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工作流自动化 45 篇

2512.02436 2026-08-11 cs.AI 版本更新 83%

Agentic AI for Clustering, Relationship Discovery, and Semantic Trading in Prediction Markets

语义交易:用于预测市场聚类和关系发现的代理AI

Agostino Capponi, Alfio Gliozzo, Brian Zhu

机构 * Columbia University(哥伦比亚大学) IBM Research(IBM研究院)

专题命中 工作流自动化 :agentic(title,abstract);workflow(abstract);分类 cs.AI

AI总结 本文提出一种代理AI方法,通过自然语言处理将预测市场划分为主题组并发现市场间的关系,利用历史数据验证其预测准确性及交易策略收益。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00079 2026-08-11 cs.LG cs.CY stat.ME 版本更新 79%

flowengineR: A Modular and Extensible Framework for Fair and Reproducible Workflow Design in R

flowengineR:R语言中用于公平性与可复现性工作流设计的模块化可扩展框架

Maximilian Willer, Peter Ruckdeschel

专题命中 工作流自动化 :workflow(title,abstract);分类 cs.LG

AI总结 flowengineR是R语言的模块化可扩展框架,用于构建可复现的机器学习工作流,支持公平性等场景下的方法整合与评估,具备透明、可扩展等特性。

Comments 27 pages, 7 figures, 1 table. v2: revised terminology (S7 renamed "Regulatory Suitability", FAIR acronym corrected), added discussion of AI governance frameworks, updated related-work positioning and references, added a caveat on LLM-assisted engine generation, and hedged claims on runtime overhead and synthetic data. Software and reported benchmarks unchanged

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09821 2026-08-11 eess.SP 新提交 78%

An open-source, scalable workflow for organizing echosounder data for machine learning applications

面向机器学习应用的开源可扩展声呐数据处理工作流

Caesar Tuguinay, Wu-Jung Lee, Valentina Staneva, Elizabeth M. Phillips, Rebecca E. Thomas, Alicia Billings, Julia Clemons

专题命中 工作流自动化 :workflow(title,abstract)

AI总结 该研究提出一种两阶段开源工作流,基于Echopype和Echoregions库构建可扩展的机器学习就绪回声测深数据集,含数据划分与掩码创建,提供教程验证其可行性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08402 2026-08-11 cs.CV 新提交 78%

Agentic AI-powered flexible fiber-bundle endoscopy for high-resolution NIR-II fluorescence imaging in vivo

智能体驱动的柔性光纤束内窥镜用于体内高分辨率近红外二区(NIR-II)荧光成像

Yanzhao Shi, Yuanhua Liu, Sixin Xu, Wayne Jason Li, Yuyuan Chen, Danyang Xu, Zhisheng Wu, Hanze Yu, Ian Yu-Hong Wong, Simon Ying-Kit Law, Hongjie Dai, Liangqiong Qu, Feifei Wang

专题命中 工作流自动化 :agentic(title);agent(abstract)

AI总结 该研究开发了AI驱动的柔性光纤束内窥镜平台,通过光学-计算协同设计及GAME流水线提升NIR-II成像分辨率,实现体内生物样本高分辨率成像,为临床转化奠定基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08248 2026-08-11 quant-ph 新提交 78%

Catching Transpilation Drift with a CI/CD Workflow in Quantum Software Development

在量子软件开发中通过CI/CD工作流捕获转译漂移

Jouni Peltonen, Otso Kinanen, Vlad Stirbu

专题命中 工作流自动化 :workflow(title,abstract)

AI总结 该研究针对量子软件开发中工具链变更导致的转译漂移问题,提出了基于GitHub Actions和MLflow的量子DevOps CI/CD工作流,可检测转译漂移并提升量子编译的可观测性与可审计性。

Comments Accepted for publication in the Q-SET Workshop at IEEE QCE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07779 2026-08-11 cs.AI 新提交 77%

The Capability Ladder: A Curriculum-Modernization Framework for Workforce Readiness in the AI Era

能力阶梯:AI时代劳动力准备的课程现代化框架

Majid Memari, George Rudolph

机构 * Utah Valley University(犹他谷大学)

专题命中 工作流自动化 :agent(abstract);AI agent(abstract);workflow(abstract);分类 cs.AI

AI总结 本文提出AI时代劳动力准备的能力阶梯课程现代化框架,将AI增强工作按操作自主性分为五级,映射到课程更新等,主张围绕持久能力针对性现代化而非全面替换。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09028 2026-08-11 cs.AI cs.CL cs.DB cs.LO 新提交 76%

PolicyKG: An Agentic LLM Pipeline for Translating Institutional Policies into SHACL Knowledge Graphs

PolicyKG:一种用于将机构政策转换为SHACL知识图谱的智能体大语言模型流水线

Ponkrit Kaewsawee, Chaklam Silpasuwanchai, Chutiporn Anutariya

机构 * Asian Institute of Technology(亚洲理工学院)

专题命中 工作流自动化 :agentic(title);分类 cs.AI、cs.CL

AI总结 本研究提出PolicyKG流水线,可自动将机构政策转换为SHACL知识图谱,在AIT语料库上取得高分类准确率,适配新领域仅需替换注册表,解决了人工转换的效率问题。

Comments 23 pages, 3 figures, 4 tables. Under review at IJCKG 2026, Bangkok, Thailand

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09332 2026-08-11 cs.LG 新提交 74%

Hallucinations and Constraints : Regulating surgical workflow recognition beyond accuracy

幻觉与约束:超越准确率的手术工作流程识别调控

John S. H. Baxter, Pierre Jannin

机构 * Université de Rennes(雷恩大学) Inserm(法国国家健康与医学研究院)

专题命中 工作流自动化 :workflow(title);分类 cs.LG

AI总结 该研究针对医学图像处理中AI的幻觉问题,提出用线性时序逻辑谓词结合概率图模型调控,在机器人辅助子宫切除术阶段识别中准确率提约10%且消除多数拓扑错误。

Comments 11 pages, 1 figure, 1 table, accepted to the MICCAI 2026 Workshop on Fairness, Regulation, and Ethics (FAIMI-BRIDGE-EPIMI 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09542 2026-08-11 cs.LG cs.AI cs.CR 新提交 73%

Dual-Adversarial Safety Alignment: Cultivating Intrinsic Threat Comprehension in LRMs

双对抗安全对齐:在大型推理模型(LRMs)中培养内在威胁理解

Hongli Shen, Shaopeng Fu, Qinbo Zhang, Jian Li, Di Wang

机构 * King Abdullah University of Science and Technology(阿卜杜拉国王科技大学) Stony Brook University(石溪大学)

专题命中 工作流自动化 :agent(abstract);autonomous agent(abstract);分类 cs.AI、cs.LG

AI总结 针对现有LRMs安全对齐方法依赖模式泛化不足的问题,提出双对抗框架AdvSafe,通过两阶段对抗博弈生成不安全知识数据集,使LRMs实现鲁棒安全对齐且权衡性能更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09185 2026-08-11 cs.DB cs.AI cs.SE 新提交 73%

SiriusDeliver: Automating Data Warehouse Delivery at Tencent

SiriusDeliver:腾讯的数据仓库交付自动化方案

Haining Xie, Xiaokai Zhou, Jiaming Yang, Siqi Shen, Ziwei Wang, Yifeng Zheng, Tengyue Xu, Yipeng Shi, Zefang Zong, Yang Li, Peng Chen, Jie Jiang, Debiao He, Xiao Yan, Jiawei Jiang

专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.AI、cs.SE

AI总结 腾讯提出SiriusDeliver端到端交付自动化智能体,集成三类组件,经离线实验和腾讯云WeData大规模部署验证,可显著提升DW交付的成功率、效率,缩短交付时间与工程师工作量。

Comments 13 pages, 13 figures, 3 tables. Under submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09719 2026-08-11 cs.HC 新提交 67%

Mirroring the Past: Exploring How Ancestral Digital Self Influences History Learning

镜像过去:探索祖先数字自我如何影响历史学习

Duo Gong, Fan Sun, Yucen Wang, Yufan Hu, Wen Zhong, Wei Zhang, Pengcheng An

专题命中 工作流自动化 :agent(abstract);workflow(abstract)

AI总结 该研究针对历史学习中学习者与自身的疏离问题,提出AI生成的“祖先数字自我”教学智能体,经被试内研究发现其可提升体验性指标,但未改善即时学习结果,为相关教育环境设计提供启示。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07952 2026-08-11 cs.LG cs.AI cs.CR cs.SE 新提交 67%

Persistent Semantic Entities in Tool-Augmented LLM Systems

工具增强型大语言模型系统中的持久语义实体

Zhaohui Wang

专题命中 工作流自动化 :agent(abstract);分类 cs.AI、cs.LG、cs.SE

AI总结 该研究定义工具增强型LLM系统的持久语义实体(PSEs),证实其在24款不同规模模型中普遍存在,偏好/指令污染难自校正,上下文隔离自验证可降低污染,为智能体系统安全提供关键发现。

Comments Accepted at the 43rd International Conference on Machine Learning (ICML 2026). Camera-ready version; 32 pages . The openreview url is https://openreview.net/forum?id=zPjmtawzT8&noteId=CXB95ws5so and ICML poster url is https://icml.cc/virtual/2026/poster/60521

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16544 2026-08-11 cond-mat.str-el cond-mat.mes-hall 版本更新 67%

AIMS: an AI experimentalist turns uncertainty into quantum matter discovery

AIMS:一种用于量子物质的不确定性感知人工智能实验者

Siyuan Qiu, Philip D. Suh, Nhat Huy Tran, Xirui Wang, Heonjoon Park, Kutay Akin, Kevin K. S. Multani, Seungwon Jung, Wenkai Cai, Xinyu Liu, León Garcia, Ziyan Zhu, Chunjing Jia, Zhantao Chen, Zhixun Shen, Zhurun Ji

专题命中 工作流自动化 :agent(abstract);AI agent(abstract)

AI总结 研究量子材料实验中的不确定性问题,提出AIMS这一不确定性感知人工智能实验者,通过连接三个嵌套循环实现感知恢复、测量选择和能量尺度分辨机制归因,展示了对量子物质的不确定性感知实验能动性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08618 2026-08-11 cs.RO cs.AI cs.CL 新提交 62%

RAG-Based Auto-Configuration for Industrial Fieldbus Devices

基于检索增强生成(RAG)的工业现场总线设备自动配置

Aadil Gani Ganie, Saad Ezzini, Naveed Farooz Marazi

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI、cs.CL

AI总结 针对工业现场总线设备手动配置的低效易错问题,提出SysName流水线,结合RAG、本地LLM与两级弃权门控,在多协议设备配置任务中实现高效高准确率的端到端自动化,经基准测试与案例验证效果优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09580 2026-08-11 cs.AI 新提交 57%

CoRCi: Cross-Reconstruction of Coherent Interests Modeling in Cross-Domain Sequential Recommendation

CoRCi:跨域序列推荐中连贯兴趣建模的跨重建方法

Qingtian Bian, Tieying Li, Marcus de Carvalho, Jiaxing Xu, Hui Fang, Yiping Ke

机构 * Nanyang Technological University(南洋理工大学) Northeastern University(东北大学) Shanghai University of Finance and Economics(上海财经大学)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 针对跨域序列推荐中域差异破坏兴趣连贯性的问题,本文提出CoRCi框架,通过跨重建方法和FocalNCE损失实现域不变兴趣对齐,在四个数据集上性能优于现有最优方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09526 2026-08-11 cs.CR cs.AI 新提交 57%

RangeFactory: Scalable Construction of Multi-Hop Cyber Ranges

RangeFactory:可扩展多跳网络靶场构建框架

Hanlin Jiang, Puyi Wang, Jiandong Jin, Shaofei Li, Zhan Shen, Pengli Wang, Ziming Wang, Yifeng Cai, Ning Jia, Yuxin Ren, Peng Jiang, Yao Guo, Ding Li

专题命中 工作流自动化 :agent(abstract);分类 cs.AI

AI总结 RangeFactory是自动化网络靶场编排框架,可规模化构建多跳靶场;其构建的RangeBench含1148个靶场实例,发现智能体存在持续入侵差距,还生成了攻击轨迹语料库。

Comments 16 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08806 2026-08-11 cs.AI 新提交 57%

Three Generations of Healthcare IT: From the Digital Record to the Computable Care Process

医疗信息技术的三代发展:从数字记录到可计算护理流程

Alexander Apartsin, Yehudit Aperstein

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 本文按系统可计算信息单元划分医疗IT,提出以患者临床意图为对象的计算层,将ACR形式化为该层原子对象,其与FHIR等互补,为可计算临床意图研究提供可复用构建块。

Comments 11 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08627 2026-08-11 cs.AI 新提交 57%

UniMoMo: Expert Merging-Based MoE Acceleration for Large Recommendation Models

UniMoMo:基于专家合并的大推荐模型混合专家(MoE)加速方法

Lei Xin, Bin Gu, Peize Li, Zitong Wang, Jianbo Zhao, Changjiang Jiang, Yanyue Xie, Chao Huang, Xuyang Zhao, Zunhai Su, Fanhu Zeng, Zhenglun Kong

机构 * Kuaishou Technology(快手科技) Hohai University(河海大学) Wuhan University(武汉大学) ByteDance, Seed(字节跳动 Seed) Alibaba, Ant Group(阿里巴巴蚂蚁集团) ByteDance, Douyin(字节跳动抖音) The University of Hong Kong(香港大学) Harvard University(哈佛大学)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 UniMoMo是一种后训练压缩框架,通过功能相似性合并MoE专家并引入层自适应保护,在Amazon Beauty等三个数据集上实现推荐MoE的高效压缩与加速,且性能损失极小。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08219 2026-08-11 cs.CV cs.AI 新提交 57%

VTO: Visual Tool Orchestration for Video Anomaly Detection

VTO:面向视频异常检测的可视化工具编排

Rui Wang, Yeteng Wu, Xianling Zhang, Mengshi Qi

机构 * State Key Laboratory of Networking and Switching Technology(网络与交换技术国家重点实验室) Beijing University of Posts and Telecommunications(北京邮电大学) School of Digital Media & Design Art(数字媒体与设计艺术学院)

专题命中 工作流自动化 :agent(abstract);分类 cs.AI

AI总结 针对视频异常检测中传统方法泛化差、多模态智能体工具编排难的问题,提出过程监督强化学习框架VTO,结合VAD-Tool工具集,在工具调度上较基线提升10.2%。

Comments Accepted by ACM MM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07494 2026-08-11 cs.HC cs.AI 新提交 57%

How to Ask the AI: A User Perspective Survey for Large Language Model Prompting

如何向AI提问:大型语言模型提示工程的用户视角调查

Yiqun Zhang, Yunfan Zhang, Mingjie Zhao, Sen Feng, Yiu-ming Cheung

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 该研究从用户视角开展大型语言模型提示工程调查,提出提示有效性评估策略、应用工作流并维护开源项目,为用户制定适配场景的有效提示提供可操作指南。

Comments Accepted to TAI

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08268 2026-08-11 math.OC cs.GT cs.LG econ.TH 新提交 57%

Learning under Opponent Unawareness in Linear-Quadratic Stochastic Games

线性二次随机博弈中对手不知情下的学习

Dantong Chu, Xuefeng Gao, Yufei Zhang

专题命中 工作流自动化 :agent(abstract);分类 cs.LG

AI总结 该研究针对线性二次随机博弈,在对手不知情的最小信息结构下,提出异步分散学习算法并证明其收敛性,应用于动态古诺竞争,发现有限信息学习降低企业利润,公开市场产出可缓解福利损失。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09104 2026-08-11 cond-mat.mtrl-sci cs.LG physics.ins-det 新提交 57%

Multitask Scanning Probe Microscopy

多任务扫描探针显微镜

Aditya Raghavan, Yu Liu, Ian Mercer, JP Maria, Sergei Kalinin

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 该研究提出多任务扫描探针显微镜,基于多任务高斯过程的闭环工作流程,实现测量位置与模态的自主选择,在AlScN晶圆上验证了其可扩展主动学习应用的价值。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05235 2026-08-11 cs.IR cs.AI 交叉投稿 57%

From Trajectories to Evidence: Auditable Experimental Records for Industrial Research Agents

从轨迹到证据:面向工业研究智能体的可审计实验记录

Zijie Zhuang, Changxin Lao, Pengbo Xu, Hanwen Xu, Ruochen Yang, Yingzhi He, Peng Zhang, Jiangxia Cao, Yusheng Huang, Guohong Mu, Jian Liang, Ruiming Tang, Shuang Yang, Zhaojie Liu, Wenwu Ou, Kun Gai

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 本研究针对工业研究智能体的实验轨迹无法自动成为有效证据的问题,提出基于证据的框架,经实验验证该框架可生成可审计记录,且生成的候选方案相对基准实现了积极在线提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20819 2026-08-11 stat.ML cs.LG 版本更新 57%

Demystifying Prediction Powered Inference

解开预测驱动推断之谜

Yilin Song, Dan M. Kluger, Harsh Parikh, Tian Gu

机构 * Department of Biostatistics, Columbia Mailman School of Public Health(哥伦比亚大学生物统计学系、哥伦比亚大学马利曼公共卫生学院) Institute for Data, Systems, and Society, Massachusetts Institute of Technology(麻省理工学院数据、系统和社会研究所) Department of Biostatistics, Yale School of Public Health(耶鲁大学生物统计学系)

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 本文通过整合PPI的理论基础和方法学扩展,提供统一的实用工作流程,帮助研究人员负责任地应用预测驱动推断。

Comments updated manuscript

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15318 2026-08-11 cond-mat.stat-mech cs.LG 版本更新 57%

Efficient identification of critical regions via Flow Matching-based Monte Carlo initialization

通过流匹配高效识别临界转变:一种可扩展的生成方法用于多体系统

Qian-Rui Lee, Daw-Wei Wang

机构 * Physics Department, National Tsing Hua University(国立清华大学物理系) Center for Theory and Computation, National Tsing Hua University(国立清华大学理论与计算中心) Center for Quantum Technology, National Tsing Hua University(国立清华大学量子技术中心)

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 通过流匹配方法高效识别多体系统临界转变,实现大规模计算物理中的快速预测与高保真度初始化。

Comments 31 pages, 22 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09062 2026-08-11 cs.CV cs.LG 版本更新 57%

SIP: Site in Pieces- A Dataset of Disaggregated Construction-Phase 3D Scans for Semantic Segmentation and Scene Understanding

SIP: 构建阶段碎片化3D扫描数据集——用于语义分割和场景理解

Seongyong Kim, Yong Kwon Cho

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 SIP数据集通过碎片化3D扫描反映施工现场实际约束,为建筑场景的语义分割和理解提供高质量基准数据。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08391 2026-08-11 stat.ME 新提交 50%

A systematic framework for the identification and statistical quantification of impulsivity in condition monitoring signals

用于状态监测信号中冲动性的识别与统计量化的系统框架

Aleksandra Grzesiek, Justyna Witulska, Daniel Kuzio, Radosław Zimroz, Tomasz Barszcz, Agnieszka Wyłomańska

专题命中 工作流自动化 :workflow(abstract)

AI总结 本研究提出一种用于状态监测信号中冲动性识别与统计量化的系统框架,通过两阶段方法及蒙特卡洛模拟、工业压缩机振动数据验证,为区分有效信号与异常干扰信号提供可扩展工具。

Comments 38 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09155 2026-08-11 cs.MA 新提交 50%

Beyond Tier Labels: Role- and Deployment-Dependent Model Substitution in Multi-Call LLM Workflows

超越层级标签:多调用大语言模型工作流中依赖角色与部署的模型替换

Renxiang Wang, Jiaming Cui

专题命中 工作流自动化 :workflow(abstract)

AI总结 该研究针对多调用LLM工作流的模型替换问题,通过谓词-动作分解分离决策,经多任务实验揭示模型价值依赖角色与部署,提出大规模工作流路由的实用序列。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09066 2026-08-11 cs.CR 新提交 50%

SSHafe: A Real-Time SSH Brute Force Attack Detection and Novel Credential Rotation Standard

SSHafe:实时SSH暴力攻击检测与新型凭证轮换标准

Aditya Mitra, Amar Kumar Mandal, Amaan Rais Shah, Iqra Naz, E. Fatih Yetkin, Tuğçe Ballı

专题命中 工作流自动化 :workflow(abstract)

AI总结 本研究提出SSHafe系统,结合时间序列特征工程与LightGBM实现实时SSH暴力攻击检测,采用新型密码重置标准提升安全性,可在10秒内抑制攻击并防止账户入侵。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08340 2026-08-11 cs.DC 新提交 50%

OpRAG: A Resource-Deterministic Runtime for GPU-Backed Multi-Stage RAG Workflows

OpRAG:面向GPU支持的多阶段RAG工作流的资源确定性运行时

Arup Kumar Sarker, Mills Staylor, Aymen Alsaadi, Gregor von Laszewski, Shantenu Jha, Geoffrey Fox

专题命中 工作流自动化 :agentic(abstract)

AI总结 本文提出OpRAG,一种面向GPU多阶段RAG的资源确定性分布式运行时,通过优化编排层降低非模型开销,在多模型多基准测试中显著提升RAG端到端性能。

Comments 14 pages, 6 figures, 5 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏