arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 10469 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工作流自动化 10469 篇

2607.16130 2026-07-20 cs.CY cs.AI cs.SY eess.SY 新提交 57%

A Methodology for Auditable Trustworthiness Levels in AI Lifecycle Governance

人工智能生命周期治理中可审计可信度水平的一种方法

Andrea Ferrario

机构 * Institute of Biomedical Ethics and History of Medicine, University of Zürich(生物医学伦理与医学史研究所,苏黎世大学) SUPSI, Dalle Molle Institute for Artificial Intelligence (IDSIA)(SUPSI人工智能研究所) ETH Zürich(苏黎世联邦理工学院)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 研究人工智能治理中系统可信度判断问题,提出轻量级方法,含形式框架与治理程序两部分,用决策树建模,能产生可信度平台等,通过合成轨迹说明方法可支持合规文档编制和生命周期监测。

Comments 32 pages; 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15027 2026-07-17 cs.AI 新提交 57%

Man, Machine, and Masterpiece: Artistic Ownership in the AI Era

人、机器与杰作:人工智能时代的艺术所有权

Sofi Gjing Jovanovska, Kuntal Ghosh, Daniel Muhu Njenga, Ahmed Mufassir, Shadan Sadeghian

机构 * University of Siegen(锡根大学)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 探讨人工智能时代艺术所有权问题,设计ArtSplit原型量化人机贡献,引发艺术家对所有权归属的反应,指出量化与艺术家对创作的理解不符,挑战将其转化为技术问题的冲动。

Journal ref NordiCHI '26 Adjunct: Adjunct Proceedings of the 14th Nordic Conference on Human-Computer Interaction, Vaasa, Finland, October 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14818 2026-07-17 cs.LO cs.AI 新提交 57%

Can LLMs Build a MaxSAT Solver from Papers? The CoreForge Experience

大语言模型能否根据论文构建最大可满足性求解器?CoreForge 经验

Ruben Martins

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 该研究利用大语言模型从论文构建无权重 MaxSAT 求解器,采用结合论文讨论、代码实现及审核修订的迭代流程,评估特定配置,发现虽未现错误答案,但性能低于手工设计求解器,总结了相关经验教训。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14542 2026-07-17 cs.CL 新提交 57%

CityLLM: A framework for natural-language querying of semantic 3D city models

CityLLM:一种用于语义 3D 城市模型自然语言查询的框架

Rabindra Lamsal, Sisi Zlatanova, Johnson Xuesong Shen

机构 * GRID Lab, School of Built Environment, UNSW Sydney(新南威尔士大学悉尼分校建筑环境学院GRID实验室) School of Civil and Environmental Engineering, UNSW Sydney(新南威尔士大学悉尼分校土木与环境工程学院)

专题命中 工作流自动化 :workflow(abstract);分类 cs.CL

AI总结 研究针对语义 3D 城市模型访问查询难的问题,提出 CityLLM 框架,结合空间与图形数据库,在基于语言模型工作流中支持迭代查询等。通过多种模型在鹿特丹数据集上评估,多个场景 54 个查询显示其性能强大,为语义 3D 城市数据对话访问提供轻量级可扩展方法。

Comments Accepted to the 21st International 3D GeoInfo Conference. To appear in the ISPRS Annals of the Photogrammetry, Remote Sensing and Spatial Information Sciences

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14452 2026-07-17 cs.SE 新提交 57%

AI-Conducted Interviews in Empirical Software Engineering: An Experience Report

实证软件工程中的人工智能主导访谈:一份经验报告

Rohit Gheyi, Danyllo Albuquerque, Márcio Ribeiro, Mirko Perkusich

专题命中 工作流自动化 :workflow(abstract);分类 cs.SE

AI总结 该经验报告探讨定制MyGPT在实证软件工程研究中主导访谈的应用,介绍其流程,分析提交工件和问卷回复,发现多数参与者评价积极,但存在局限,表明人工智能访谈可作补充选项,需相关设计与监督。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14486 2026-07-17 physics.chem-ph cond-mat.mtrl-sci cs.LG 新提交 57%

Full-data accuracy with fewer labels for training and fine-tuning machine-learning force fields

在训练和微调机器学习力场时使用更少标签实现全数据精度

Sheng Bi, Yi-Ze Wang, Jun Cheng

机构 * College of Materials(材料学院) Xiamen University(厦门大学) State Key Laboratory of Physical Chemistry of Solid Surfaces(固体表面物理化学国家重点实验室) iChEM, College of Chemistry and Chemical Engineering(iChEM,化学与化工学院) Laboratory of AI for Electrochemistry (AI4EC)(电化学人工智能实验室) IKKEM

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 研究针对机器学习力场构建训练集的瓶颈问题,提出基于最后一层投影回归的主动学习工作流程,能识别高价值训练集,在基础模型微调和迭代电解质微调中表现出色,实现用更少标签达到全数据精度,提供可扩展的不确定性量化策略。

Comments 23 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07520 2026-07-17 hep-ph cs.LG 版本更新 57%

Lecture notes on Machine Learning applications for global fits

机器学习在全局拟合中的应用讲义

Jorge Alda

机构 * Dipartimento di Fisica e Astronomia “Galileo Galilei”, Università degli Studi di Padova and INFN Sezione Padova(帕多瓦大学伽利略·伽利莱物理与天文系及意大利国家核物理研究院帕多瓦分部) Centro de Astropartículas y Física de Altas Energías (CAPA)(高能天体物理与高能物理中心(CAPA))

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 本文介绍了利用现代机器学习方法进行高能物理全局统计拟合的框架,重点包括使用Boosted Decision Trees近似对数似然函数,以及通过SHAP值解释模型参数影响,最终应用于B±→K±νν异常问题。

Comments Lecture notes for the 4th COMCHA School on Computing Challenges in Zaragoza (Spain), 8-15 April 2026. 25 pages, 10 figures, 14 code snippets, 1 appendix. Submission to SciPost Physics Lecture Notes. Fixed minor typos and improved visual presentation of figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13372 2026-07-16 cs.CL 新提交 57%

A POS Tier Is the Key to Automated Annotation for Low-Resource Language Documentation: Neural Interlinear Glossing for Irabu, a Southern Ryukyuan Language

词性层级是低资源语言文献自动标注的关键:针对南琉球语伊良部语的神经语符标注

Michinori Shimoji

机构 * Kyushu University(九州大学)

专题命中 工作流自动化 :workflow(abstract);分类 cs.CL

AI总结 研究针对濒危语言伊良部语语符标注成本高的问题,用小型BiLSTM-CRF模型构建神经标注管道。发现黄金词性标注可提升语法语符标注,词性层级能减少所需语符化数据量,虽全自动管道未完全实现增益,但为文献实践提供四线标注建议。

Comments 15 pages, 9 figures, 8 tables. Code, corpus, and complete per-sentence test outputs: https://github.com/MichinoriShimoji/ML_autogloss

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13156 2026-07-16 cs.SE 新提交 57%

Design-System-Aware Development with AI: Evaluating Productivity and Design Consistency

基于人工智能的设计系统感知开发:评估生产力和设计一致性

Luciane Silva, Thayssa Rocha, Nicole Davila, Gustavo Pinto

专题命中 工作流自动化 :workflow(abstract);分类 cs.SE

AI总结 研究前端开发中从高保真原型转换界面的挑战,通过在巴西企业的对照实验,比较手动、仅DS及DS感知的AI辅助开发,发现AI辅助能显著加速开发、提高设计保真度,为工业前端工作流带来实际益处。

Comments SBES Industry 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13040 2026-07-16 cs.CY cs.AI 新提交 57%

Final Authority in AI Governance: Frontier-Provider Sovereignty and Action-Centered Deployer Governance

人工智能治理中的最终权威:前沿提供者主权与以行动为中心的部署者治理

Zexun Wang

机构 * Ond Holdings Inc.(奥恩德控股公司)

专题命中 工作流自动化 :agentic(abstract);分类 cs.AI

AI总结 探讨人工智能系统嵌入组织流程后最终权威归属,比较前沿提供者主权与以行动为中心的部署者主权两种模式,通过多种分析发现支持分布式运营问责制,强调可移植治理层价值,得出分层结论。

Comments 23 pages, 5 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12943 2026-07-15 cs.SE 新提交 57%

Salesforce Messaging Architecture: Platform Events, Async Sends, and Multi-Tenancy at Scale

Salesforce 消息传递架构:大规模平台事件、异步发送和多租户

Devam Gupta

专题命中 工作流自动化 :workflow(abstract);分类 cs.SE

AI总结 研究提出在 CRM 内部原生构建消息传递核心的架构范式,将消息视为原生 CRM 记录,出站路径为平台原生事务,状态参数存为标准数据库对象,利用此范式评估了相关设计模式、扩展机制、解耦约束及架构边界。

Comments 8 pages, 1 table. An earlier version of this work was first posted on SSRN (DOI: 10.2139/ssrn.6903158)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12541 2026-07-15 cs.SE 新提交 57%

Taming the Drift: Context-aware Repair of Dockerfile Drift during Software Evolution

驯服漂移:软件演化过程中Dockerfile漂移的上下文感知修复

Chengjie Wang, Jingzheng Wu, Xiang Ling, Tianyue Luo, Chen Zhao

专题命中 工作流自动化 :workflow(abstract);分类 cs.SE

AI总结 研究针对软件演化中Dockerfile漂移致CI/CD构建失败的问题,提出上下文感知框架Cadre,通过构建CDG并结合两步工作流程来修复,在$D^3$基准上修复率高,相比基线优势明显,还避免提示溢出故障,提升了上下文感知基础设施即代码维护能力。

Comments 18 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12382 2026-07-15 cs.LG q-bio.NC 新提交 57%

Differentiable Clone-Structured Causal Graphs for End-to-End Cognitive Map Learning from Image Sequences

用于从图像序列进行端到端认知地图学习的可微克隆结构因果图

Arash Nikzad, Sasan Sarbishegi, Ali Dasmeh, Muhammad Asif, Parsa Gharavi, Erik Husom, Sagar Sen, Andrew B. Lehr, Olivier Penacchio, Ana Clemente, Tristan M. Stöber

机构 * Goethe University Frankfurt(歌德大学法兰克福分校) Max Planck Institute for Human Development(马克斯·普朗克人类发展研究所) Max Planck Institute for Empirical Aesthetics(马克斯·普朗克实验美学研究所) SINTEF(挪威科技工业研究院) University Medical Center Göttingen(哥廷根大学医学中心) Institute of Computer Science and Campus Institute Data Science, University Göttingen(哥廷根大学计算机科学与数据科学研究所) Bridging Research in AI and Neuroscience (brAIN), Computer Vision Center(人工智能与神经科学交叉研究中心(brAIN),计算机视觉中心) Computer Science Department, Universitat Autònoma de Barcelona(巴塞罗那自治大学计算机科学系) Epilepsy Center Frankfurt Rhine-Main, Department of Neurology, Goethe University Frankfurt(歌德大学法兰克福分校莱茵-美因癫痫中心,神经学系) Circulant Labs(循环实验室)

专题命中 工作流自动化 :agent(abstract);分类 cs.LG

AI总结 研究如何让智能体从图像序列构建世界结构化地图。核心方法是将CSCG重构成可微模块gradCSCG并与VQ-VAE前端耦合,有软发射前向传播和损失平衡机制。主要贡献是证明该方法能在多环境下从视觉输入高精度恢复邻接图,CSCG可作深度学习构建块。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11816 2026-07-14 cs.LG stat.ML 新提交 57%

Relaxing Faithfulness with Intervention-Only Causal Discovery

通过仅干预因果发现放松忠实性

Bijan Mazaheri, Jiaqi Zhang, Caroline Uhler

机构 * Thayer School of Engineering Dartmouth College(达特茅斯学院塞耶工程学院) Broad Institute of MIT and Harvard(麻省理工学院和哈佛大学布罗德研究所) Massachusetts Institute of Technology(麻省理工学院)

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 研究因果发现算法,指出常见流程中第一步的忠实性假设在自然系统中常被违反。提出干预即时忠实性假设,表明其足以用硬干预非参数识别因果结构,将干预作为因果结构信息主要载体,还针对干预范围有限情况指定等价类。

Comments Accepted to UAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10839 2026-07-14 cs.SE 新提交 57%

Maintenance and Support in Community-Driven Scientific Pipeline Ecosystems: A Cross-Platform Empirical Study of nf-core

社区驱动的科学管道生态系统中的维护与支持:对nf-core的跨平台实证研究

Khairul Alam, Kowsik Roy, Md Shamimur Rahman, Banani Roy

专题命中 工作流自动化 :workflow(abstract);分类 cs.SE

AI总结 研究社区驱动的科学管道生态系统nf-core中的维护与支持,通过分析大量GitHub问题、拉取请求及论坛讨论来研究相关问题、解决因素等,发现不同平台作用不同,解决结果与多种因素有关,跨平台分析揭示了内部可追溯性及联系有限的情况。

Comments 42 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10039 2026-07-14 physics.data-an cs.LG hep-ph 新提交 57%

Are We Ready for AI-Driven Discovery? AI Verification Before the Next Fundamental Physics Breakthrough

我们准备好迎接人工智能驱动的发现了吗?在下一次基础物理学突破之前进行人工智能验证

Gaia Grosso, Vinicius Mikuni, Lukas Heinrich

机构 * NSF AI Institute for Artificial Intelligence and Fundamental Interactions(NSF人工智能与基本相互作用研究院) MIT Laboratory for Nuclear Science(MIT核科学实验室) School of Engineering and Applied Sciences, Harvard University(哈佛大学工程与应用科学学院) Nagoya University(名古屋大学) Technical University Munich(慕尼黑技术大学) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心)

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 探讨在基础物理学中,随着机器学习日益自主,确保其可靠性至关重要。通过VERaiPHY计划框架,结合统计发现工作流程确定验证时机,强调归纳偏差等局限,思考物理学家角色,以实现机器学习在物理学中负责任的整合。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11712 2026-07-14 cs.LG cond-mat.mtrl-sci 新提交 57%

CatRetriever: Contrastive Representation Learning for Slab-to-Bulk Retrieval in Generative Catalyst Discovery

CatRetriever:用于生成催化剂发现中从平板到体相检索的对比表示学习

Jungho Oh, Woosung Kim, Dong Hyeon Mok, Jonggeol Na, Seoin Back

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 研究针对生成催化剂模型平板与体相连接缺失问题,提出对比表示学习模型CatRetriever,能准确检索体相候选物,还扩展其框架为吸附能目标体相发现管道,为连接催化剂生成模型与体相催化剂发现提供可扩展途径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16524 2026-07-14 cs.CV cs.LG physics.comp-ph physics.data-an 版本更新 57%

An Approximate Graph Elicits Detonation Lattice

近似图激发爆轰晶格

Vansh Sharma, Venkat Raman

机构 * Department of Aerospace Engineering, University of Michigan(密歇根大学航空航天工程系)

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 本文提出基于图论的新型算法,用于精确分割和测量爆轰细胞,解决传统2D边缘检测方法的局限性,通过分割模型实现无训练的准确提取细胞模式。

Comments 3D Detonation; Soot Foil; Graph; Cell Classification; Cellular Detonation; Detonation Lattice; SAM Model

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23993 2026-07-14 cs.CL 版本更新 57%

The GRADIEND Python Package: An End-to-End System for Gradient-Based Feature Learning

GRADIEND Python包:一种基于梯度的特征学习端到端系统

Jonathan Drechsel, Steffen Herbold

机构 * Faculty of Computer Science and Mathematics University of Passau(计算机科学与数学学院 巴伐利亚大学)

专题命中 工作流自动化 :workflow(abstract);分类 cs.CL

AI总结 GRADIEND Python包提供端到端系统,通过语言模型中的事实-反事实MLM和CLM梯度学习特征方向,并支持特征数据创建、训练、评估及多特征比较。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15353 2026-07-14 stat.AP cs.LG stat.ML 版本更新 57%

Reinforcement Learning in the Real World: A Survey of Statistical Challenges and Future Directions

现实世界中的强化学习:统计挑战与未来方向综述

Asim H. Gazi, Yongyi Guo, Daiqi Gao, Ziping Xu, Kelly W. Zhang, Susan A. Murphy

机构 * Department of Computer Science, Harvard University(哈佛大学计算机科学系) Department of Statistics, University of Wisconsin–Madison(威斯康星大学麦迪逊分校统计学系) Department of Statistics, Harvard University(哈佛大学统计学系) School of Data Science and Society, University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校数据科学与社会学院) Department of Mathematics, Imperial College London(伦敦帝国理工学院数学系)

专题命中 工作流自动化 :agent(abstract);分类 cs.LG

AI总结 本文综述现实世界强化学习应用,指出其研究与部署存在差距及两大挑战。将应用框架化为三部分过程,回顾应对统计挑战的进展,涵盖在线、离线方法及持续改进设计,还概述受应用启发的未来研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13330 2026-07-14 cs.CL 版本更新 57%

RegCheck: A tool for structured comparisons between study registrations and papers

RegCheck:一个用于研究注册与论文之间结构化比较的工具

Jamie Cummins, Beth Clarke, Ian Hussey, Malte Elson

机构 * Bennett Institute of Applied Data Science, University of Oxford(贝内特应用数据科学研究所,牛津大学) Institute of Psychology, University of Bern(心理学研究所,伯恩大学)

专题命中 工作流自动化 :workflow(abstract);分类 cs.CL

AI总结 介绍RegCheck工具,用于比较研究注册与论文。利用人工智能,模块化设计,让用户决定比较特征并提供相关文本,生成可共享报告,适用于多领域多格式,有望成为可重复科学的可扩展基础设施。

Comments 26 pages, 4 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03174 2026-07-14 cs.AI 版本更新 57%

InqEduAgent: Adaptive AI Learning Partners with Gaussian Process Augmentation

InqEduAgent:具有高斯过程增强的自适应人工智能学习伙伴

Wen-Xi Yang, Tian-Fang Zhao, Guan Liu

机构 * Guangdong Institute of Smart Education(广东智能教育研究院) Jinan University(暨南大学) School of Journalism and Communication(新闻与传播学院)

专题命中 工作流自动化 :agent(abstract);分类 cs.AI

AI总结 研究针对探究式教育中学习伙伴分配问题,提出InqEduAgent框架,集成高斯过程增强匹配机制,能基于先验知识模式选自适应伙伴,实验证明其性能优越,推进了人机协作学习及相关领域发展。

Comments Accepted by the 2026 8th Asia Conference on Machine Learning and Computing (ACMLC 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09378 2026-07-13 quant-ph cs.AI cs.CR 新提交 57%

When Routes Run Out: Adversarial Co-Learning and Explainable Robustness in Quantum Repeater Networks

当路线耗尽时:量子中继器网络中的对抗协同学习与可解释鲁棒性

Brennan Bell, Inti Gabriel Mendoza Estrada, Andreas Trügler, Paul Erker

机构 * RFI-IRFOS and TU Graz(RFI-IRFOS和格拉茨技术大学) openmaind FlexCo and TU Graz(openmaind FlexCo和格拉茨技术大学) Know Center Research GmbH and University of Graz(Know Center Research GmbH和格拉茨大学) Atominstitut, TU Wien and IQOQI, ÖAW(原子院、维也纳技术大学和ÖAW IQOQI)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 研究量子中继器网络路由对抗博弈问题,通过对抗协同学习,发现保留率与参考值紧密跟踪,拟合决策树解释模型并报告忠实度,构建提示记录形成开源解释工作流程。

Comments 4 pages, 5 figures, submitted to IEEE QCE26, Workshop on Q-GenAI: Synergies between QC & GenAI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.07459 2026-07-13 cs.CL 版本更新 57%

Beyond LLMs: A Linguistic Approach to Causal Graph Generation from Narrative Texts

超越大语言模型:一种从叙事文本生成因果图的语言学方法

Zehan Li, Ruhua Pan, Xinyu Pi

机构 * University of California, San Diego(加州大学圣地亚哥分校)

专题命中 工作流自动化 :agent(abstract);分类 cs.CL

AI总结 该研究提出从叙事文本生成因果图的框架,先以LLM提取顶点,引入含七个语言特征的“专家索引”并集成到分类模型,结合RoBERTa嵌入提升因果关系识别精度,经五次迭代提示构建因果图,实验证明其优于GPT-4o和Claude 3.5,还提供开源工具。

Comments published at the 7th Workshop on Narrative Understanding, NAACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10062 2026-07-10 cs.AI cs.MA 新提交 57%

Deployment-Time Memorization in Foundation-Model Agents

基础模型智能体中的部署时记忆

Lei, Chen, Guilin Zhang, Kai Zhao, Dalmo Cirne, Andy Olsen, Xu Chu, Zeke Miller, Alet Blanken, Amine Anoun, Jerry Ting

机构 * Lei (Rachel) Chen Guilin Zhang Kai Zhao Dalmo Cirne Andy Olsen Zeke Miller Xu Chu Alet Blanken Amine Anoun Jerry Ting

专题命中 工作流自动化 :agent(abstract);分类 cs.AI

AI总结 研究基础模型智能体在部署时记忆的设计选择如何影响个性化效用、提取风险和删除保真度,提出遗忘残差分数并揭示压缩与删除的权衡。

Comments 4 pages, ICML MemFM 2026 Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.05969 2026-07-10 cs.CR cs.SE 版本更新 57%

Heimdallr: Characterizing and Detecting LLM-Induced Security Risks in GitHub CI Workflows

Heimdallr:在GitHub CI工作流中识别和检测LLM引发的安全风险

Bonan Ruan, Yeqi Fu, Chuqi Zhang, Jiahao Liu, Jun Zeng, Zhenkai Liang

专题命中 工作流自动化 :workflow(abstract);分类 cs.SE

AI总结 本文研究GitHub CI工作流中LLM引发的安全风险,提出Heimdallr框架,通过流程图规范化和威胁向量检测,实现高精度识别LLM节点和威胁向量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04920 2026-07-10 cs.AI 版本更新 57%

Conversational AI for Rapid Scientific Prototyping: A Case Study on ESA's ELOPE Competition

用于快速科学原型设计的对话式人工智能:以欧空局的ELOPE竞赛为例

Nils Einecke

机构 * Honda Research Institute Europe GmbH(本田欧洲研究机构)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 以欧空局ELOPE竞赛为例,探讨用ChatGPT进行快速科学原型设计。介绍其在竞赛中的表现,包括提供代码、推理等,虽有局限但凸显人机协作潜力,分析优缺点,提出将大语言模型集成到科学工作流程可增强快速原型设计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06802 2026-07-09 eess.SP cs.AI 新提交 57%

A Multi-Analyst LLM Pipeline for Auditable Rule Discovery Across 68 Public Physiological Corpora

用于跨68个公共生理语料库进行可审计规则发现的多分析师大语言模型管道

Dovy Paukstys

机构 * Komori Care, LLC(科莫里护理公司)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 针对开放生理语料库异质性无法确定新监测平台探测器规则的问题,提出多分析师大语言模型工作流程,通过读取语料库文档、去重、审核、整合等操作,产生可审计规则形状库及探测器组件,推动文献规则向硬件验证发展。

Comments 8 pages, 2 figures, 9 tables; submitted to IEEE SPMB 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07521 2026-07-09 cs.HC cs.AI 新提交 57%

Creativity from Friction: Human-AI Interaction for Exploratory Structural Design

摩擦产生创造力:用于探索性结构设计的人机交互

Ricardo Maia Avelino, Rita Sevastjanova, Tom Van Mele, Philippe Block, Mennatallah El-Assady

机构 * Block Research Group, Department of Architecture, ETH Zurich(建筑系,苏黎世联邦理工学院) IVIA Lab, Department of Computer Science, ETH Zurich(计算机科学系,苏黎世联邦理工学院)

专题命中 工作流自动化 :AI agent(abstract);分类 cs.AI

AI总结 探讨当前生成式AI目标与结构设计师等创作者需求的偏差,提出允许受限人机共同创作的系统设计维度,通过试点设计界面和专家研究,展示其对设计空间探索的支持及设计师看法。

Comments Accepted at ICML 2026, Workshop on Human-AI Co-Creativity

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07504 2026-07-09 cs.AI 新提交 57%

Do LLM-Generated Skills Make Better AI Data Scientists? A Component Ablation Across Data-Science Workflows

大语言模型生成的技能能否造就更好的人工智能数据科学家?跨数据科学工作流程的组件消融

Wei-Jung Huang

机构 * Independent Researcher(独立研究者)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 研究大语言模型生成的技能在数据科学工作流程中的作用,通过在四个阶段测试及组件消融实验发现,完整生成技能及消融后的技能变体与任务单独提示相比,均未显著提升性能,提醒勿将其作为默认单次提示策略。

Comments KDD 2026 Workshop on AI Data Scientist

Journal ref KDD 2026 Workshop on AI Data Scientist

详情

展开后加载摘要…

URL PDF HTML 收藏