arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 10427 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工作流自动化 10427 篇

2605.29931 2026-05-29 cs.AI eess.AS 79%

It`s All About Speed: AI`s Impact on Workflow in Music Production

一切都关乎速度:AI对音乐制作工作流程的影响

Finn McClellan, Fabio Morreale

机构 * Waipapa Taumata Rau - University of Auckland, Auckland (Aotearoa - New Zealand)(瓦伊帕塔玛拉大学——奥克兰大学,奥克兰(奥特亚罗——新西兰)) Sony AI, Barcelona (Spain)(索尼AI,巴塞罗那(西班牙))

专题命中 工作流自动化 :workflow(title,abstract);分类 cs.AI

AI总结 通过民族志研究,探讨AI和自动化工具如何影响音乐制作工作流程,重点关注录音工程师、混音师和制作人的使用体验与态度,并分析速度、可控性与创造性自主权之间的张力及其缓解方法。

Comments Audio Engineering Society Conference Paper - Presented at the AES International Conference on Machine Learning and Artificial Intelligence for Audio 2025 - September 8-10, London, UK

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29253 2026-05-29 cs.AI 79%

OpenClawBench: Benchmarking Process-side Anomalies in Real-world Agent Execution Trajectories

OpenClawBench: 真实智能体执行轨迹中过程侧异常的基准测试

Yibing Liu, Yangze Liu, Xiaolong Yin, Bin Wang, Chong Zhang, Hao Yin, Zhongyi Han

机构 * School of Software, Shandong University(山东大学软件学院) School of Artificial Intelligence, Nanjing University(南京大学人工智能学院;南京大学新型软件技术国家重点实验室) State Key Laboratory of Novel Software Technology, Nanjing University(医学人工智能中心;青岛中医药科学院;海洋传统中医研究所,山东中医药大学) Center for Medical Artificial Intelligence(四川大学软件工程学院) Qingdao Academy of Chinese Medical Sciences Institute of Marine Traditional Chinese Medicine, Shandong University of Traditional Chinese Medicine School of Software Engineering, Sichuan University

专题命中 工作流自动化 :agent(title,abstract);分类 cs.AI

AI总结 提出OpenClawBench数据集,通过FullTax标注框架量化智能体执行中的过程侧异常,揭示仅基于结果评估的不足。

Comments 37 pages, 1 figure, 43 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.05828 2026-05-28 cs.SE 79%

From Chat to Interview: Agentic Requirements Elicitation with an Experience Ontology

从聊天到访谈:基于经验本体的智能需求获取

Dongming Jin, Zhi Jin, Yaotian Yang, Linyu Li, Zheng Fang, Yuanpeng He, Wenchun Jing, Xiaohong Chen

专题命中 工作流自动化 :agentic(title);agent(abstract);分类 cs.SE

AI总结 提出OntoAgent智能体,通过构建经验本体引导需求访谈,实现自动化、系统化且可解释的需求获取,在网站应用领域显著提升获取效果和提问效率。

Journal ref RE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26825 2026-05-27 cs.SE 79%

On the GitHub Actions Language: Usage, Evolution, and Workflow Reliability

关于 GitHub Actions 语言:使用、演变和工作流可靠性

Aref Talebzadeh Bardsiri, Alexandre Decan, Tom Mens

专题命中 工作流自动化 :workflow(title,abstract);分类 cs.SE

AI总结 本文通过分析 49K 仓库中的 260K 工作流,实证研究了 GitHub Actions 语言结构的使用和演变如何影响工作流可靠性与可维护性,发现复杂工作流与高失败率和维护成本相关,并识别出与风险相关的特定特征。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.01037 2026-05-27 cs.CR cs.AI cs.PL 79%

Certified Purity for Cognitive Workflow Executors: From Static Analysis to Cryptographic Attestation

认知工作流执行器的认证纯度:从静态分析到密码学证明

Alan L. McCann

机构 * Mashin, Inc.(Mashin公司)

专题命中 工作流自动化 :workflow(title,abstract);分类 cs.AI

AI总结 提出一种认证纯度架构,通过WebAssembly编译、密码签名证书和运行时验证门,将认知工作流系统中的治理执行从运行时约定转变为结构性能力边界,消除BEAM虚拟机上的对抗性绕过。

Comments 23 pages, 4 figures, 8 tables. Companion proofs: https://github.com/mashin-live/governance-proofs. Project: https://mashin.live. Updated license

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.01030 2026-05-27 cs.AI cs.LO cs.PL 79%

Effect-Transparent Governance for AI Workflow Architectures: Semantic Preservation, Expressive Minimality, and Decidability Boundaries

AI工作流架构的效果透明治理:语义保持、表达最小性与可判定性边界

Alan L. McCann

机构 * Mashin, Inc.(Mashin公司)

专题命中 工作流自动化 :workflow(title,abstract);分类 cs.AI

AI总结 本文通过机器验证的形式化方法,证明在AI工作流架构中,效果级治理可以在不降低内部计算表达性的前提下实施,并建立了治理与计算表达性正交的理论基础。

Comments 15 pages. Companion proofs: https://github.com/mashin-live/governance-proofs. Project: https://mashin.live. v2: corrected cross-reference identifiers for companion papers. License updated

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26346 2026-05-27 cs.CL 79%

The Daily Dose: Workflow-Integrated Large Language Model Automation for Clinical Summarization and Trial Identification in Radiation Oncology

每日剂量:工作流集成的大型语言模型自动化在放射肿瘤学中的临床总结和试验识别

Jason Holmes, Federico Mastroleo, Mariana Borras-Osorio, Srinivas Seetamsetty, Satomi Shiraishi, Mirek Fatyga, Judy C. Boughey, Cornelius A. Thiels, William G. Breen, Daniel J. Ma, Daniel K. Ebner, David M. Routman, Brady S. Laughlin, Carlos E. Vargas, Samir H. Patel, Sujay A. Vora, Nadia N. Laack, Andrew Y. K. Foong, Wei Liu, Mark R. Waddle

机构 * Department of Radiation Oncology, Mayo Clinic, Phoenix, AZ, United States(辐射肿瘤科,梅奥诊所,凤凰城,亚利桑那州,美国) Department of Radiation Oncology, Mayo Clinic, Rochester, MN, United States(辐射肿瘤科,梅奥诊所,罗切斯特,明尼苏达州,美国) Division of Radiation Oncology, IEO, European Institute of Oncology, IRCCS, Milan, Italy(放射肿瘤学部,IEO,欧洲肿瘤研究所,IRCCS,米兰,意大利)

专题命中 工作流自动化 :workflow(title,abstract);分类 cs.CL

AI总结 本文介绍了一个名为“每日剂量”的LLM驱动的自动化临床总结和临床试验识别系统,该系统集成到常规放射肿瘤学实践中,并通过混合方法评估其可用性、满意度和感知有用性,结果显示高使用率和满意度。

Comments 28 pages, 4 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25701 2026-05-26 cs.DC cs.CL cs.IR cs.NI 79%

Neural Router: Semantic Content Matching for Agentic AI

神经路由器:面向智能体AI的语义内容匹配

Lauri Lovén, Abhishek Kumar, Alexander Engelhardt, Alaa Saleh, Roberto Morabito, Xiaoli Liu, Naser Hossein Motlagh, Sasu Tarkoma

机构 * Future Computing Group, University of Oulu(奥卢大学未来计算组) Department of Computer Science, University of Helsinki(赫尔辛基大学计算机科学系) Department of Communication Systems, EURECOM(EURECOM通信系统部门)

专题命中 工作流自动化 :agentic(title,abstract);分类 cs.CL

AI总结 本文提出将大语言模型作为内容发布/订阅代理的语义匹配引擎,通过分析上下文窗口交叉点和判别能力交叉点,实现成本-准确性权衡,并给出三个可组合算法和自主LLM层级选择框架。

Comments 35 pages, 12 figures. Combined main paper and electronic supplement, folded into one document for arXiv

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24784 2026-05-26 cs.AI 79%

GRAIL: AI translation for scientists application workflow on satellite data

GRAIL:面向卫星数据科学家应用工作流的AI翻译

Zhuocheng Shang, Ahmed Eldawy

机构 * University of California, Riverside(加州大学河滨分校)

专题命中 工作流自动化 :workflow(title);agentic(abstract);分类 cs.AI

AI总结 提出GRAIL系统,通过LangGraph管道将Python地理空间工作流翻译为可扩展的Spark程序,无需科学家学习新框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24756 2026-05-26 cs.AI 79%

Proper Scoring Rules for Agentic Uncertainty Quantification

智能体不确定性量化的适当评分规则

Suresh Raghu, Satwik Pandey, Shashwat Pandey

机构 * Independent Researcher(独立研究者)

专题命中 工作流自动化 :agentic(title,abstract);分类 cs.AI

AI总结 针对语言模型智能体轨迹中的不确定性信号,提出严格适当的轨迹评分规则TPS,用于评估逐步骤成功概率过程,并处理删失数据。

Comments 38 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24002 2026-05-26 physics.chem-ph cond-mat.mtrl-sci cs.AI physics.comp-ph 79%

Harnessing AtomisticSkills for Agentic Atomistic Research

利用原子技能实现代理原子研究

Bowen Deng, Bohan Li, Matthew Cox, Hoje Chun, Juno Nam, Artur Lyssenko, Sathya Edamadaka, Jurgis Ruza, Xiaochen Du, Nofit Segal, Jesus Diaz Sanchez, Mingrou Xie, Ty Perez, Yu Yao, Miguel Steiner, Sauradeep Majumdar, Charles B. Musgrave, Anirban Chandra, Abhirup Patra, Detlef Hohl, Connor W. Coley, Ju Li, Rafael Gómez-Bombarelli

机构 * Department of Materials Science Engineering, Massachusetts Institute of Technology, Cambridge, MA 02139, USA Department of Chemical Engineering, Massachusetts Institute of Technology, Cambridge, MA 02139, USA Department of Chemistry, Kookmin University, Seoul 02707, Republic of Korea Harvard University, Department of Chemistry Department of Chemistry, Massachusetts Institute of Technology, Cambridge, MA 02139, USA Department of Nuclear Science Shell Information Technology International Inc., Texas 77082, United States Shell International Exploration \& Production Inc., Texas 77079, United States

专题命中 工作流自动化 :agentic(title);agent(abstract);分类 cs.AI

AI总结 提出AtomisticSkills框架,通过分层分解科学工作流为技能和工具,使通用AI编码代理能够进行原子级研究,并在多个科学任务中验证其能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11650 2026-05-22 physics.chem-ph cs.AI 79%

Large Language Model Agent for User-friendly Chemical Process Simulations

面向用户友好的化学过程模拟的大语言模型代理

Jingkang Liang, Niklas Groll, Gürkan Sin

机构 * Process and System Engineering Center(过程与系统工程中心) Department of Chemical and Biochemical Engineering(化学与生物化学工程系) Technical University of Denmark(丹麦技术大学)

专题命中 工作流自动化 :agent(title,abstract);分类 cs.AI

AI总结 本文提出一种基于大语言模型的代理,通过Model Context Protocol与AVEVA Process Simulation集成,实现自然语言交互进行化学过程模拟,提升非专业用户对复杂过程设计、仿真和优化的访问能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20734 2026-05-21 cs.CR cs.AI 79%

An Application-Layer Multi-Modal Covert-Channel Reference Monitor for LLM Agent Egress

面向LLM代理出站的应用层多模态隐通道参考监控器应用

Alfredo Metere

机构 * Enclawed, LLC(Enclawed公司)

专题命中 工作流自动化 :agent(title,abstract);分类 cs.AI

AI总结 本文提出了一种应用层多模态隐通道参考监控器,用于检测和防止LLM代理在消息中泄露数据,通过多阶段文本管道、媒体加密器和残余容量测量来实现对隐通道的监控和管理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16630 2026-05-20 cs.CR cs.AI 79%

PrivScope: Task-scoped Disclosure Control for Hybrid Agentic Systems

PrivScope:面向混合代理系统的任务范围披露控制

Shafizur Rahman Seeam, Zhengxiong Li, Zhiyuan Yu, Yimin, Chen, Yidan Hu

机构 * Rochester Institute of Technology(罗切斯特理工学院) University of Colorado Denver(科罗拉多大学丹佛分校) Texas A&M University(德克萨斯大学阿姆斯特朗分校) University of Massachusetts Lowell(马萨诸塞大学洛厄尔分校)

专题命中 工作流自动化 :agentic(title);workflow(abstract);分类 cs.AI

AI总结 本文提出PrivScope,一种在本地与云语言模型之间实施任务范围披露控制的可信本地负载管理者,旨在防止在混合代理系统中因任务无关上下文、先前工作流残留信息和过于具体的敏感细节导致的过度披露问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18764 2026-05-20 cs.IR cs.AI 79%

From Intent to AI Pipelines: A Controlled Agentic Framework for Non-AI Expert Scientists

从意图到AI流水线:一种受领域驱动的可控代理框架,用于非AI专家科学家

Hyacinth Ali, Jessie Galasso-Carbonnel, Houari Sahraoui

机构 * University of Montreal(蒙特利尔大学) McGill University(麦吉尔大学)

专题命中 工作流自动化 :agentic(title,abstract);分类 cs.AI

AI总结 本文提出DDAP框架,通过分阶段交互帮助非AI专家科学家系统构建AI流水线及其实现代码,展示了可控代理框架在生成竞争性AI流水线方面的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11844 2026-05-15 cs.SE 79%

The Death Spiral of Open Source Projects: A Post-Mortem Analysis of Pull Request Workflow Dynamics

开源项目的死亡螺旋:对拉取请求工作流动态的回顾分析

Mohit Kaushik, Kuljit Kaur Chahal

专题命中 工作流自动化 :workflow(title,abstract);分类 cs.SE

AI总结 本文通过分析1736个非活跃GitHub仓库和130万个人驱动的拉取请求,揭示了拉取请求工作流中摩擦、审查周期延长和负面惩罚等微观动态对开源项目生存的影响,发现项目寿命由内在价值和生态系统动态决定。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12443 2026-05-13 eess.SY astro-ph.IM cs.MS cs.SE cs.SY 79%

Basilisk and Docker for Reproducible GN&C Simulation: A Workflow Reference

Basilisk和Docker用于可重复的GN&C模拟:一个工作流参考

Anubhav Gupta

专题命中 工作流自动化 :workflow(title,abstract);分类 cs.SE

AI总结 本文提出基于Docker的Basilisk工作流,提供可重复和可移植的GN&C模拟环境,涵盖从轨道动力学到姿态动力学的复杂模拟场景。

Comments 21 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11221 2026-05-13 q-bio.QM cs.LG 79%

Beyond Manual Curation: Augmenting Targeted Protein Degradation Databases via Agentic Literature Extraction Workflows

超越手动整理:通过代理文献提取流程增强靶向蛋白降解数据库

Yaochen Rao, Farzaneh Jalalypour, N. M. Anoop Krishnan, Rocío Mercado

机构 * Department of Computer Science and Engineering(计算机科学与工程系) Chalmers University of Technology(楚姆勒斯技术大学) University of Gothenburg(哥德堡大学) Yardi School of Artificial Intelligence(Yardi人工智能学院) Indian Institute of Technology Delhi(德里印度理工学院)

专题命中 工作流自动化 :agentic(title);workflow(abstract);分类 cs.LG

AI总结 本文提出一种基于代理的LLM工作流,通过三角比较提升靶向蛋白降解数据库的提取效率,实现了数据库的自动化扩展与验证,提高了数据质量和应用价值。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08520 2026-05-12 cs.LG cs.DC 79%

FlashEvolve: Accelerating Agent Self-Evolution with Asynchronous Stage Orchestration

FlashEvolve:通过异步阶段协调加速智能体自我进化

Zhengding Hu, Mingge Lu, Zhen Wang, Jixuan Ruan, Chang Chen, Zaifeng Pan, Yue Guan, Ruiyi Wang, Zhongkai Yu, Chao Zhang, Yufei Ding

机构 * University of California, San Diego(加州大学圣地亚哥分校) Georgia Institute of Technology(佐治亚理工学院)

专题命中 工作流自动化 :agent(title);workflow(abstract);分类 cs.LG

AI总结 本文提出FlashEvolve框架,通过异步工作流和队列降低智能体自我进化的时间成本,提升吞吐量和token效率,在GEPA任务中实现3.5倍和4.9倍的提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08480 2026-05-12 cs.AI 79%

AI-Care: A Conversational Agentic System for Task Coordination in Alzheimer's Disease Care

AI-Care:一种用于阿尔茨海默病护理的任务协调对话代理系统

Preyash Yadav, Michelle Cohn, Priyanka Koppolu, Hritvik Agarwal, Amey Gohil, Tejas Patil, Sasha Pimento, Alyssa Weakley

机构 * Department of Computer Science(计算机科学系) Department of Linguistics(语言学系) Department of Neurology(神经病学系) University of California, Davis(加州大学戴维斯分校)

专题命中 工作流自动化 :agentic(title,abstract);分类 cs.AI

AI总结 AI-Care通过自然语言交互降低阿尔茨海默病患者使用数字工具的认知负担,通过语音优先聊天机器人实现日程提醒和待办事项管理,采用状态化 orchestration 方法确保安全性和准确性。

Comments 9 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08445 2026-05-12 cs.AI 79%

Measuring What Matters: Benchmarking Generative, Multimodal, and Agentic AI in Healthcare

衡量重要性:在医疗保健中基准测试生成、多模态和代理AI

Prasanna Desikan, Harshit Rajgarhia, Shivali Dalmia, Ananya Mantravadi

机构 * Centific AI Research(Centific人工智能研究)

专题命中 工作流自动化 :agentic(title);workflow(abstract);分类 cs.AI

AI总结 本文探讨了在医疗保健中评估生成、多模态和代理AI的基准测试方法,强调了现有基准测试在可靠性、安全性和临床相关性方面的不足,提出需要系统性的评估框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.00425 2026-05-11 cs.AI 79%

AEM: Adaptive Entropy Modulation for Multi-Turn Agentic Reinforcement Learning

AEM:多轮代理强化学习中的自适应熵调节

Haotian Zhao, Songlin Zhou, Yuxin Zhang, Stephen S. -T. Yau, Wenyu Zhang, Lun Tian, Tianshu Zhu, Yifeng Huang, Yucheng Zeng, Jingnan Gu, Daxiang Dong, Jianmin Wu

机构 * Baidu(百度) Tsinghua University(清华大学) Fudan University(复旦大学)

专题命中 工作流自动化 :agentic(title,abstract);分类 cs.AI

AI总结 AEM通过自适应调节熵动态,改进多轮代理强化学习中的探索与利用平衡,无需监督即可提升性能。

Comments 30 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01390 2026-05-08 cs.HC cs.AI 79%

Toward Scalable Audio Description Quality Control: A Workflow for Evaluating Human and VLM Raters

迈向可扩展的音频描述质量控制:评估人类和VLM评分者的流程

Lana Do, Gio Jung, Juvenal Francisco Barajas, Andrew Taylor Scott, Shasta Ihorn, Alexander Mario Blum, Vassilis Athitsos, Ilmi Yoon

机构 * Northeastern University(东北大学) San Francisco State University(旧金山州立大学) University of Texas at Arlington(德克萨斯大学阿灵顿分校)

专题命中 工作流自动化 :workflow(title,abstract);分类 cs.AI

AI总结 本文提出了一种评估人类和VLM评分者音频描述质量的流程,利用项目反应理论评估其与专家标准的匹配程度,发现VLM在大规模评估中可与人类评分者相当,但其推理可靠性较低。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23758 2026-04-30 cs.LG cond-mat.mtrl-sci 79%

Agentic Fusion of Large Atomic and Language Models to Accelerate Superconductors Discovery

代理融合大规模原子和语言模型以加速超导体发现

Mingze Li, Yu Rong, Songyou Li, Lihong Wang, Jiacheng Cen, Liming Wu, Anyi Li, Zongzhao Li, Qiuliang Liu, Rui Jiao, Tian Bian, Pengju Wang, Hao Sun, Jianfeng Zhang, Ji-Rong Wen, Deli Zhao, Shifeng Jin, Tingyang Xu, Wenbing Huang

机构 * Gaoling School of Artificial Intelligence, Renmin University of China, Beijing, China(中国人民大学北京校区人工智能学院) DAMO Academy, Alibaba Group, Hangzhou, China(阿里巴巴集团达摩院,杭州,中国) Hupan Lab, Hangzhou, China(虎扑实验室,杭州,中国) Institution of Physics, University of the Chinese Academy of Sciences, Beijing, China(中国科学院物理研究所,北京,中国) Department of Computer Science and Technology, Tsinghua University, Beijing, China(清华大学计算机科学与技术系,北京,中国)

专题命中 工作流自动化 :agentic(title,abstract);分类 cs.LG

AI总结 本文提出ElementsClaw框架,结合大规模原子模型与语言模型,通过自主协作加速超导体发现,筛选240万晶体识别6.8万高置信度候选,发现四个新实验验证超导体。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26311 2026-04-30 cs.AI 79%

DreamProver: Evolving Transferable Lemma Libraries via a Wake-Sleep Theorem-Proving Agent

DreamProver:通过唤醒-睡眠定理证明代理演化可转移的引理库

Youyuan Zhang, Jialiang Sun, Hangrui Bi, Chuqin Geng, Wenjie Ma, Zhaoyu Li, Xujie Si

机构 * University of Toronto(多伦多大学) UC Berkeley(伯克利大学)

专题命中 工作流自动化 :agent(title);agentic(abstract);分类 cs.AI

AI总结 DreamProver通过唤醒-睡眠程序归纳范式发现可重用的引理,解决传统方法在适应性和通用性上的不足,通过迭代两阶段过程演化出高效的可转移引理库。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23483 2026-04-28 cs.AI 79%

Agentic Adversarial Rewriting Exposes Architectural Vulnerabilities in Black-Box NLP Pipelines

代理对抗重写揭示了黑盒NLP流水线中的架构漏洞

Mazal Bethany, Kim-Kwang Raymond Choo, Nishant Vishwamitra, Peyman Najafirad

机构 * Department of Information Systems and Cybersecurity, University of Texas at San Antonio(信息系统与网络安全系,德克萨斯大学圣安东尼奥分校)

专题命中 工作流自动化 :agentic(title);agent(abstract);分类 cs.AI

AI总结 本文提出一种双代理逃逸框架,通过语义扰动空间在无梯度反馈和严格查询预算下测试NLP流水线的鲁棒性,发现架构选择影响攻击面,并通过模式指导防御降低逃逸率。

Comments Submitted to IEEE TRANSACTIONS ON INFORMATION FORENSICS AND SECURITY

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15319 2026-04-23 cs.HC cs.AI 79%

Explainable Iterative Data Visualisation Refinement via an LLM Agent

通过LLM代理的可解释迭代数据可视化细化

Burak Susam, Tingting Mu

机构 * Department of Computer Science, University of Manchester(曼彻斯特大学计算机科学系)

专题命中 工作流自动化 :agent(title);agentic(abstract);分类 cs.AI

AI总结 本文提出利用LLM代理的自动化方法,通过结合定量评估与人类洞察,实现高维数据可视化优化,生成高质量可视化结果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18228 2026-04-21 cs.SE 79%

Towards an Agentic LLM-based Approach to Requirement Formalization from Unstructured Specifications

迈向基于代理的LLM方法:从非结构化规范中提取需求形式化

Alberto Tagliaferro, Bruno Guindani, Livia Lestingi, Matteo Rossi

专题命中 工作流自动化 :agentic(title,abstract);分类 cs.SE

AI总结 本文提出基于代理的方法,从非结构化规范中自动生成符合验证要求的形式化属性,通过提取、过滤和翻译三个模块,实现语义对齐,实验表明其在三个场景中准确率达77.8%。

Comments Accepted at the AIPV 2026 workshop (non-archival)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17677 2026-04-21 cs.AI 79%

Semantic Entanglement in Vector-Based Retrieval: A Formal Framework and Context-Conditioned Disentanglement Pipeline for Agentic RAG Systems

向量检索中的语义纠缠:一种形式框架和上下文条件下的解缠管道用于智能RAG系统

Nick Loghmani

机构 * Salesforce School of Information Studies, Syracuse University(苏利文大学信息研究学院)

专题命中 工作流自动化 :agentic(title);agent(abstract);分类 cs.AI

AI总结 本文提出了一种形式框架和上下文条件解缠管道,用于解决向量检索中因多主题文档交织导致的语义纠缠问题,通过改进文档结构提升检索精度。

Comments 34 pages, 5 Figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17347 2026-04-21 cs.AI 79%

Formal Foundations of Agentic Business Process Management

代理业务流程管理的正式基础

Giuseppe De Giacomo, Timotheus Kampik, Lukas Kirchdorfer, Marco Montali, Christoph Weinhuber

机构 * University of Oxford, UK(牛津大学,英国) SAP, Germany(德国SAP公司) Umeå University, Sweden(乌梅拉大学,瑞典) University of Mannheim, Germany(曼海姆大学,德国) Free University of Bozen-Bolzano, Italy(博兹纳自由大学,意大利)

专题命中 工作流自动化 :agentic(title,abstract);分类 cs.AI

AI总结 本文探讨了代理业务流程管理系统的数学基础,分析了四个核心问题,提出通过显式目标约束代理决策能力,以实现流程规范的控制。

详情

展开后加载摘要…

URL PDF HTML 收藏