arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 806 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工作流自动化 806 篇

2608.03626 2026-08-05 cs.CR cs.AI cs.CY 新提交 70%

A Security-Oriented Lifecycle Model for Large Language Model Systems

面向大型语言模型系统的安全导向生命周期模型

Eleftherios Batzolis, George Drosatos, Vassilis Katsouros, Konstantinos Rantos

专题命中 工作流自动化 :workflow(abstract);agentic(abstract);分类 cs.AI

AI总结 本文针对LLM系统生命周期框架重效率轻安全、治理与生命周期阶段脱节的问题,提出含32个阶段的安全导向生命周期模型,整合多监管框架发现治理证据分布不均的结构特性。

Comments Accepted as: Batzolis, E., Drosatos, G., Katsouros, V., & Rantos, K. (2026). A Security-Oriented Lifecycle Model for Large Language Model Systems. In: Kieseberg, P., Skopik, F., Atli, B., Schrittwieser, S., & Asplund, M. (Eds.), Availability, reliability and security---ARES 2026 EU Projects Symposium workshops (Lecture Notes in Computer Science, pp. 1-18). Springer Nature Switzerland

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00745 2026-08-04 cs.AI 新提交 70%

Behavioral Grammar: Detecting Adaptive Malware via Tiny Language Model Priors and Second-Order Temporal Analysis

行为语法:通过微型语言模型先验和二阶时序分析检测自适应恶意软件

Zihan Luo

专题命中 工作流自动化 :agent(abstract,abstract_cn);分类 cs.AI

AI总结 本文提出Behavioral Grammar架构,用0.88M参数的TinyGPT学习主机行为语法,结合多模块提升检测能力,在AAA威胁下实现93%检测率,建立利于防御者的结构不对称性。

Comments 29 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24766 2026-07-29 cs.AI 新提交 70%

Crystalis: Progressive Nucleation and Semantic Annealing for Coordinated Multi-View Visualization Generation

Crystalis:用于协同多视图可视化生成的渐进式成核与语义退火

Dazhen Deng, Zhaoping He, Xin Qian, Xiaotong Wang, Zi Ying, Yingcai Wu

机构 * Zhejiang University(浙江大学)

专题命中 工作流自动化 :workflow(abstract);agentic(abstract);分类 cs.AI

AI总结 研究针对大语言模型难以生成协同多视图可视化的问题,提出Crystalis框架,基于以查询为中心的CMV建模,通过渐进式成核和语义退火机制,在多任务基准测试中取得高成功率,且经用户研究验证了工作流程可用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22578 2026-07-28 cs.AI 新提交 70%

HeraSys: Collaborative Serving of Multiple LLM Workflows via Fine-Grained End-to-End Optimization

HeraSys:通过细粒度端到端优化实现多个大语言模型工作流的协同服务

Size Li, Zhiqing Tang, Hongrui Liang, Jianxiong Guo, Jiong Lou, Tian Wang, Weijia Jia

专题命中 工作流自动化 :workflow(abstract);agentic(abstract);分类 cs.AI

AI总结 针对大语言模型服务系统,HeraSys通过细粒度编排消除工作流间计算冗余,引入负载感知联合调度策略,结合资源倾斜机制等,有效减轻尾部延迟并提高吞吐量,实验证明其能显著降低延迟、提升服务吞吐量。

Comments to be published in ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20216 2026-07-23 cs.CR cs.AI 新提交 70%

Small, Free, and Effective: Orchestrating Open-Weight Small Language Models to Outperform Single LLM for Malware Analysis

小巧、免费且高效:编排开放权重的小型语言模型以在恶意软件分析中超越单个大语言模型

Adel ElZemity, Shujun Li, Budi Arief

专题命中 工作流自动化 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 研究恶意软件分析中,小型语言模型编排集成能否超越单个大语言模型。通过测试多种模型建立基线,设计评估四种编排架构,其中混合系统表现出色,总体准确率超专业和前沿基线,证明基于证据的编排可提升SLM性能。

Comments To appear in Proceedings of the 29th International Symposium on Research in Attacks, Intrusions, and Defenses (RAID)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14006 2026-07-16 cs.CR cs.AI 新提交 70%

Rethinking Penetration Testing for AI-Enabled Systems: From Resource Compromise to Behavioral Objective Violation

重新思考人工智能系统的渗透测试:从资源妥协到行为目标违反

Mohammad Allahbakhsh, Mohammad Hassan Bahari, Moslem Attar-Raouf

机构 * Sensifai BV(Sensifai公司)

专题命中 工作流自动化 :workflow(abstract);agentic(abstract);分类 cs.AI

AI总结 本文重新思考人工智能系统渗透测试,将其定义为目标驱动的行为评估,涵盖多种对抗途径。提出测试工作流程,通过实例展示渗透可通过行为影响发生,为评估已部署人工智能系统中的对抗成功提供技术框架。

Comments 42 pages, 5 Tables, 21 references

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09900 2026-07-14 cs.SE 新提交 70%

AfterVibe: What Remains When the Conversation Ends

AfterVibe:对话结束后留下了什么

Matteo Paltenghi, Satish Chandra

专题命中 工作流自动化 :agent(abstract);AI agent(abstract);分类 cs.SE

AI总结 AfterVibe框架从vibe编码会话恢复自然语言规范,用语言模型提取规范并经再生测试验证,在72个项目上评估发现其恢复的规范抽象且强,优于人工描述,可迭代加强,意味着规范或成人工审查主要工件和记录来源。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09616 2026-07-13 cs.ET cs.AR cs.LG cs.SY eess.SY 新提交 70%

LLM for EDA in Front-End Design: Challenges and Opportunities

用于前端设计中电子设计自动化的大语言模型:挑战与机遇

Kangwei Xu, Bing Li, Ulf Schlichtmann

机构 * Chair of Electronic Design Automation, Technical University of Munich(电子设计自动化教授团,慕尼黑技术大学) Resource-Efficient AI Group, Technical University of Ilmenau(高效人工智能小组,伊门豪技术大学)

专题命中 工作流自动化 :autonomous agent(abstract);agentic(abstract);分类 cs.LG

AI总结 探讨芯片前端设计瓶颈下,大语言模型在电子设计自动化中的潜力,回顾其在前端设计关键任务及流程中的进展,讨论集成大语言模型到EDA面临的挑战与限制,概述未来机遇,为相关研究提供系统视角。

Comments Invited paper at the ACM/IEEE DAC 2026 Special Research Session, 5 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08938 2026-07-13 cs.SE 新提交 70%

Better Harnesses, Smaller Models: Building 90% Cheaper Agents via Automated Harness Adaptation

更好的框架,更小的模型:通过自动框架适配构建成本降低90%的智能体

Chenyang Yang, Xinran Zhao, Tongshuang Wu, Christian Kästner

专题命中 工作流自动化 :agent(abstract);agentic(abstract);分类 cs.SE

AI总结 研究针对前沿语言模型智能体推理成本高的问题,提出通过自动框架适配让小语言模型智能体以低90%成本匹配语言模型性能,创建相关框架和优化器,经实验验证该方法能扩大小语言模型智能体在日常业务任务中的部署范围。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02134 2026-07-13 cs.AI 新提交 70%

Coding-agents can replicate scientific machine learning papers

编码代理可以复现科学机器学习论文

Atharva Hans, Ilias Bilionis

机构 * School of Mechanical Engineering, Purdue University(机械工程学院,普渡大学)

专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.AI

AI总结 提出Paper-replication工作流,让编码代理以目标驱动方式复现论文的计算声明,通过记录目标、重建方法、运行实验并验证,在四篇论文的12次独立运行中全部完成并通过验证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08257 2026-07-10 cs.AI 新提交 70%

MentalHospital: A Virtual Environment for Evaluating Psychiatric Clinical Encounters

精神病院:一个用于评估精神科临床问诊的虚拟环境

Yuming Yang, Xiao Sun, Yuanwei Zou, Zhengxiao Wu, Yun Chen, Jiang Zhong, Haoyang Zeng, Jingwang Huang, Kaiwen Wei

机构 * School of Computer Science, Chongqing University(重庆大学计算机科学学院) School of Computer Science, Hunan University(湖南大学计算机科学学院)

专题命中 工作流自动化 :planning(abstract);workflow(abstract);分类 cs.AI

AI总结 研究针对大语言模型在精神科临床问诊评估不足的问题,引入MentalHospital虚拟环境,实例化S.O.A.P.工作流程,用双轨协议评估,开发MentalEval,经测试其具有临床保真度且与专家高度一致,指出大语言模型在精神状态评估上落后临床医生。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05465 2026-07-08 cs.CV cs.AI 新提交 70%

CanvasAgent: Enabling Complex Image Creation and Editing via Visual Tool Orchestration

CanvasAgent:通过视觉工具编排实现复杂图像创建和编辑

Hairui Zhu, Yiying Yang, Tengjin Weng, Ziyu Lu, Xiao Yao, Xiaoyang Ye, Lin Ma, Wenhao Jiang

机构 * Guangdong Laboratory of Artificial Intelligence and Digital Economy (SZ)(广东省人工智能与数字经济实验室(深圳))

专题命中 工作流自动化 :agent(abstract);tool-use(abstract);分类 cs.AI

AI总结 研究复杂图像创建编辑问题,提出CanvasAgent代理,通过多轮交互编排异构视觉工具,先经监督微调学习轨迹,再用广义信赖域策略优化器结合多种信号优化,结合CanvasCraft数据集进行实验,证明其对复杂多工具图像创建工作流程有效。

Comments 18pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02459 2026-07-03 cs.CL 新提交 70%

Language Models as Measurement Apparatus for Culture

语言模型作为文化测量仪器

Kent K. Chang

机构 * School of Information University of California, Berkeley(信息学院加州大学伯克利分校)

专题命中 工作流自动化 :workflow(abstract);agentic(abstract);分类 cs.CL

AI总结 本文提出语言模型的文化测量是物质-话语实践,通过Karen Barad的能动切割概念,论证模型设计选择构成所测量的文化现实,并通过三个案例和三个仪器检查展示这一观点。

Comments Accepted to the Big Picture workshop co-located with ACL 2026. This version expands the camera-ready (adding Fig. 3 and section 6.3, as well as correcting minor typos) in Proceedings of The Big Picture v2: Crafting a Research Narrative, pp. 131--143, San Diego, CA, USA. Association for Computational Linguistics

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17041 2026-07-02 cs.CL cs.IR 新提交 70%

MetaSyn: A Benchmark for LLM Agents on Meta-Analysis Articles from Nature Portfolio

对Nature Portfolio元分析文章进行LLM代理基准测试

Anzhe Xie, Weihang Su, Yujia Zhou, Yiqun Liu, Min Zhang, Qingyao Ai

机构 * Tsinghua University(清华大学)

专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.CL

AI总结 提出MetaSyn数据集,包含442篇专家策划的元分析,用于评估LLM代理在检索-筛选-综合全流程中的表现,发现当前系统在筛选阶段存在严重瓶颈。

Comments 17 pages, 8 figures, 11 tables. Code and evaluation: https://github.com/THUIR/MetaSyn Dataset: https://huggingface.co/datasets/THUIR/MetaSyn Model: https://huggingface.co/BFTree/MA-Retriever

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31572 2026-07-01 cs.SE 新提交 70%

FormIDEAble: Safe and Socially-aware Autonomous Systems

FormIDEAble:安全且具有社会感知能力的自主系统

Livia Lestingi, Amel Bennaceur, Marcello M. Bersani, Carlos Gavidia-Calderon, Anastasia Kordoni, Mark Levine, Bashar Nuseibeh, Matteo Rossi

专题命中 工作流自动化 :agent(abstract);autonomous agent(abstract);分类 cs.SE

AI总结 提出FormIDEAble方法,通过带代价的马尔可夫决策过程建模人机协作,将决策形式化为代价有界可达性问题,在保证安全的同时实现社会感知策略合成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31144 2026-07-01 cs.RO cs.AI 新提交 70%

A Modular Vision-Language-Action Robotics Framework for Indoor Environments

面向室内环境的模块化视觉-语言-动作机器人框架

Anindya Jana, Snehasis Banerjee, Arup Sadhu, Ranjan Dasgupta

机构 * TCS Research, Tata Consultancy Services(塔塔咨询服务公司TCS研究部) CMU(卡内基梅隆大学)

专题命中 工作流自动化 :agent(abstract);autonomous agent(abstract);分类 cs.AI

AI总结 提出模块化架构,集成环境建图、问题处理和导航,通过双流并行处理(语义体素建图与语言分类)实现自然语言指令驱动的自主任务执行。

Comments IEEE IROS 2025 Workshop on Generative AI for Robotics and Smart Manufacturing

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27154 2026-07-01 cs.AI 新提交 70%

OpenRCA 2.0: From Outcome Labels to Causal Process Supervision

OpenRCA 2.0:从结果标签到因果过程监督

Aoyang Fang, Yifan Yang, Jin'ao Shang, Qisheng Lu, Junjielung Xu, Rui Wang, Songhan Zhang, Yuzhong Zhang, Boxi Yu, Pinjia He

机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))

专题命中 工作流自动化 :tool use(abstract);agentic(abstract);分类 cs.AI

AI总结 针对现有根因分析数据集仅标注结果而忽略因果传播路径的问题,提出PAVE协议重建因果路径,构建OpenRCA 2.0基准,发现LLM在根因定位中因果验证不足的缺陷。

Comments work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25337 2026-06-25 cs.RO cs.AI cs.HC 新提交 70%

AI Coaching for Accelerating Human Skill Development with Reinforcement Learning

AI教练:利用强化学习加速人类技能发展

Wei Wang, Enlin Gu, Antonio Loquercio, Haimin Hu, Rahul Mangharam

机构 * University of Pennsylvania(宾夕法尼亚大学) Johns Hopkins University(约翰霍普金斯大学)

专题命中 工作流自动化 :agent(abstract);AI agent(abstract);分类 cs.AI

AI总结 本文提出一种基于非合作动态博弈和强化学习的AI教练框架,通过自适应共享控制和因果影响模型加速人类运动技能发展,在无人机竞速用户研究中显著提升学习效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22731 2026-06-23 cs.AI cs.MA 新提交 70%

Closed-loop Auto Research for Molecular Property Prediction: Discovering and Certifying Generalizable Improvements

分子性质预测的闭环自动研究:发现并认证可泛化的改进

Jingjie Ning, Xiaochuan Li, Ji Zeng, Chenyan Xiong, Guolin Ke

机构 * DP Technology

专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.AI

AI总结 提出闭环自动研究框架,通过语言模型代理编辑表示、模型代码和外部证据,在分子性质预测任务上评估改进的泛化性,发现特征、模型和数据三个轴线的可迁移性因基准而异,并验证了污染过滤对迁移的必要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20601 2026-06-23 cs.HC cs.AI 新提交 70%

Zhinong AI: A Design-Science Study of an AI-Enabled Agricultural Decision-Support Platform for Smallholder Production

Zhinong AI:面向小农生产的AI赋能农业决策支持平台的设计科学研究

Zhaoyang Li, Jiaqi Liu, Ruijie Zhang

机构 * University of Sanya(三亚大学) Hebei International Studies University(河北国际关系学院)

专题命中 工作流自动化 :planning(abstract);workflow(abstract);分类 cs.AI

AI总结 本文通过设计科学研究,提出了一个集成信息推送、问答、诊断、日历管理等功能的小农决策支持平台,并构建了分层架构、闭环流程、评估指标和治理框架,为AI农业原型转化为可测试、负责任的基础设施提供了结构化研究框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16839 2026-06-16 cs.SE 新提交 70%

Towards LLM Accelerated Rapid Reviews for Software Tool Discovery -- Case for Log Anomaly Detection

面向软件工具发现的LLM加速快速综述——以日志异常检测为例

Jesse Nyyssölä, Hamza Bin Mazhar, Alexander Bakhtin, Matteo Esposito, Nana Reinikainen, Yuqing Wang, Ying Song, Davide Taibi, Mika Mäntylä

专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.SE

AI总结 提出一种结合LLM筛选和编码代理的流水线,用于快速识别和运行软件工具,在日志异常检测案例中实现高效综述。

Comments 52nd Euromicro Conference on Software Engineering and Advanced Applications (SEAA) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12834 2026-06-12 cs.AI 新提交 70%

Fantastic Scientific Agents and How to Build Them: AgentBuild for Rietveld Refinement

神奇的科学智能体及其构建方法:用于Rietveld精修的AgentBuild

Woong Shin, Craig A. Bridges, Marshall T. McDonnell, Rafael Ferreira da Silva

机构 * UT-Battelle, LLC(UT-Battelle有限责任公司) US Department of Energy (DOE)(美国能源部)

专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.AI

AI总结 提出AgentBuild框架,通过科学家编写的合同(包含评分标准、课程和知识库)自动构建科学智能体,用于X射线衍射数据的Rietveld精修,实现可复用的智能体编译而非手动调优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11238 2026-06-12 q-fin.GN cs.AI 新提交 70%

Artificial Intelligence in Ship Finance: Applications, Opportunities, and a Case Study in AI-Augmented Loan Origination

人工智能在船舶金融中的应用:机遇与AI增强贷款发起的案例研究

Lasse Dierich, Orestis Schinas

机构 * ShipFinance.ai HHX.blue GmbH Technical University of Munich(慕尼黑技术大学) University of the Aegean(爱琴海大学)

专题命中 工作流自动化 :workflow(abstract);agentic(abstract);分类 cs.AI

AI总结 本文探讨AI在船舶金融中的应用,提出基于大语言模型的模块化架构,用于文档理解、信息提取和工作流自动化,以支持贷款申请流程。

Comments 9 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10241 2026-06-10 cs.AI 新提交 70%

Regimes: An Auditable, Held-Out-Gated Improvement Loop Demonstrated on LongMemEval with ActiveGraph

Regimes: 一种可审计的、保留验证集的改进循环——在ActiveGraph上的LongMemEval演示

Yohei Nakajima

专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.AI

AI总结 提出Regimes,一种基于事件溯源的可审计自主改进循环,通过ActiveGraph运行时实现故障记录、重放和保留集验证,在LongMemEval-S上提升0.05-0.10的准确率。

Comments 30 pages, 5 figures. Code and committed runs: https://github.com/yoheinakajima/regimes

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09674 2026-06-09 cs.AI cs.LO math.CO 新提交 70%

(Auto)formalization is supposed to be easy: Trellis process semantics for spelling out rigorous proofs

(自动)形式化应该很简单:用于详细阐述严格证明的Trellis过程语义

Wesley Pegden

机构 * Department of Mathematical Sciences, Carnegie Mellon University(卡内基梅隆大学数学科学系)

专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.AI

AI总结 提出Trellis系统,通过确定性约束工作流和LLM代理迭代细化自然语言证明,实现Lean自动形式化,强调严格证明的可细化性。

Comments 15 pages, 7 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09084 2026-06-09 cs.CR cs.AI 新提交 70%

Context-Fractured Decomposition Attacks on Tool-Using LLM Agents: Exploiting Artifact Provenance Gaps

上下文碎片化解构攻击:利用工具使用LLM代理的工件来源鸿沟

Xiaofeng Lin, Yukai Yang, Daniel Guo, Sahil Arun Nale, Charles Fleming, Guang Cheng

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.AI

AI总结 针对工具使用LLM代理,提出上下文碎片化解构(CFD)攻击,利用跨上下文工件来源鸿沟实现多步越狱,成功率提升高达28.3个百分点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08661 2026-06-09 cs.CR cs.AI cs.DB 新提交 70%

Data Agents Under Attack: Vulnerabilities in LLM-Driven Analytical Systems

数据代理遭受攻击:LLM驱动的分析系统中的漏洞

Kuncan Wang, Ziting Wang, Peizhuo Lv, Haoyang Li, Guoliang Li, Gao Cong, Wei Dong

机构 * Nanyang Technological University, Singapore(南洋理工大学,新加坡) The Hong Kong Polytechnic University(香港理工大学) Tsinghua University(清华大学)

专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.AI

AI总结 本研究系统分析了LLM驱动的数据代理的安全漏洞,提出了分层漏洞框架和攻击分类法,并在六个系统上评估了攻击效果,揭示了当前系统的重大安全缺陷。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14207 2026-08-17 cs.RO cs.CV 新提交 67%

MMUSV-Sim: A Perception-Oriented Simulation and Data-Generation Platform for Multi-USV Cooperative Perception

MMUSV-Sim:面向多无人水面艇协同感知的感知导向型仿真与数据生成平台

Ziao Li, Jianxiong Ye, Biao Tang, Leping Zhang, Kun Zuo, Siyu Huang, Chenqiang Gao

机构 * School of Intelligent Systems Engineering, Sun Yat-sen University(中山大学智能工程学院) School of Intelligent Imagery Engineering, Beijing Film Academy(北京电影学院智能影像工程学院)

专题命中 工作流自动化 :agent(abstract);workflow(abstract)

AI总结 该研究提出基于Unreal Engine 5和Project AirSim的MMUSV-Sim仿真与数据生成平台,用于多USV协同感知,实验表明其生成的数据集可使激光雷达协同BEV船舶检测的AP@0.5达72.74,显著优于单USV方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13063 2026-08-14 cs.AI cs.CL cs.LG 新提交 67%

Explanatory Engagement Under Rare Anomalous Failure: Asymptotic Rarity in Model Behavior (or: The Asymptotic AI)

罕见异常失效下的解释性参与:模型行为中的渐近稀有性(或:渐近式AI)

Sam Mao

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本研究探究LLM在低可控失效概率工作流中,解释性参与度随失效渐近稀有性的变化,发现触发结构是关键调节变量,不同模型的异常识别与参与表现存在差异。

Comments 11 figures. Elicitation-condition sweep across three open-weight models (qwen3:8b, llama3.1:8b, mistral:7b); pipeline scripts and experimental data available upon reasonable request

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12375 2026-08-14 cs.DB 新提交 67%

Pipeline Denotational Design: Correct-by-Construction Data Pipelines at Zero Cost

管道指称设计:零成本的构造正确性数据管道

Nikos Karayannidis

专题命中 工作流自动化 :agent(abstract);AI agent(abstract)

AI总结 提出管道指称设计(PDD)方法论,在设计时零成本实现数据管道构造正确性,可验证 AI 生成管道的粒度一致性,已在生产工具链中实现并评估。

Comments Extended version of a work-in-progress paper; the experimental evaluation is in progress and will appear in a later revision. Builds on a companion grain theory paper, arXiv:2601.00995

详情

展开后加载摘要…

URL PDF HTML 收藏