AI Debris: Residual Risk and the Afterlife of Failed AI Systems
AI 残骸:失败 AI 系统的残余风险与后续影响
专题命中 工作流自动化 :workflow(abstract)
AI总结 本文提出“AI 残骸”概念,指退役 AI 系统产生的残余风险,并开发了包含五个领域的分类法和 AI 残骸退役协议(AIDP),以帮助监管机构、审计师和组织加强 AI 生命周期治理。
AI 大模型
智能体、工具调用、规划、工作流、多智能体和自主任务执行。
AI 残骸:失败 AI 系统的残余风险与后续影响
专题命中 工作流自动化 :workflow(abstract)
AI总结 本文提出“AI 残骸”概念,指退役 AI 系统产生的残余风险,并开发了包含五个领域的分类法和 AI 残骸退役协议(AIDP),以帮助监管机构、审计师和组织加强 AI 生命周期治理。
耀斑带精细结构的自动检测作为耀斑重联中等离子体团动力学的代理
专题命中 工作流自动化 :workflow(abstract)
AI总结 提出一种自动检测耀斑带前沿螺旋和波状结构的方法,应用于高分辨率3D爆发耀斑模拟的磁力线长度图,发现这些特征与等离子体团介导的间歇性重联相关。
DrivingAgent: 自动驾驶系统的设计与调度智能体
机构 * Wangxuan Institute of Computer Technology, Peking University(北京大学王选计算机技术研究所) ; University of California, Merced(加州大学默塞德分校)
专题命中 工作流自动化 :agent(abstract)
AI总结 提出DrivingAgent框架,通过自动化模块开发(设计阶段)和强化学习训练的轻量级LLM实时调度(调度阶段),解决自动驾驶系统集成新模型和满足实时约束的挑战,在nuScenes和Bench2Drive上取得更优速度-精度权衡。
ShrinkageTrees: 用于生存分析和因果推断的贝叶斯树集成R包
专题命中 工作流自动化 :workflow(abstract)
AI总结 ShrinkageTrees是一个R包,通过贝叶斯加性回归树模型处理右删失和区间删失生存数据,支持因果推断中的预后和治疗效应分解,并引入深度惩罚、Dirichlet分裂和马蹄铁先验等正则化策略,适用于高维场景。
一种用于空中机器人微检测的模块化双相机流水线
机构 * Netherlands Organization for Scientific Research (NWO)(荷兰科学研究组织) ; Saxion University of Applied Sciences(萨克逊应用科学大学)
专题命中 工作流自动化 :planning(abstract)
AI总结 提出一种模块化双相机空中微检测流水线,通过变焦云台相机和广角立体导航相机协同工作,结合视觉反馈回路,实现对树木和温室粘虫板等非结构目标的鲁棒微检测。
fitPALSpectra: 正电子湮灭寿命谱的Python拟合
专题命中 工作流自动化 :workflow(abstract)
AI总结 提出开源Python工作流fitPALSpectra,通过解析积分指数-高斯响应模型、约束优化和最小二乘精化,实现可配置的PALS谱模拟、拟合、可视化和报告,在合成谱上准确恢复寿命、强度等参数。
Comments 6 pages, 2 figures
基于SCAPS-1D和机器学习的双层与常规钙钛矿太阳能电池多层筛选:面向高效架构的ETL、HTL和吸收层优化
专题命中 工作流自动化 :workflow(abstract)
AI总结 结合SCAPS-1D模拟与机器学习,系统筛选125种多层钙钛矿电池结构,发现Cs2AgInBr6基无铅双钙钛矿器件效率达28.62%,SHAP分析揭示HTL带隙等关键参数。
空间模型选择与不确定性量化:连续与离散伤口愈合模型的比较
专题命中 工作流自动化 :agent(abstract)
AI总结 针对空间过程建模中偏微分方程与基于智能体模型的选择问题,提出基于近似贝叶斯计算的模型选择流程,发现平均场PDE在计算速度和模型选择上优于ABM,并应用于伤口愈合数据。
无人机多光谱影像观测的多角度反射率各向异性
机构 * University of Information Engineering(信息工程大学)
专题命中 工作流自动化 :workflow(abstract)
AI总结 提出一种几何感知的多角度观测提取流程,从BRDF角度量化观测几何效应,通过SFM精化相机参数并重投影同质区域,联合提取多波段反射率和观测几何参数,发现红边和近红外波段反射率变化达119-137%。
射频指纹编年史
专题命中 工作流自动化 :workflow(abstract)
AI总结 本文回顾射频指纹(RFF)从1993年至2026年的发展历程,分析其范式转变,包括瞬态方法、稳态特征、机器学习和深度学习阶段,并指出信道依赖、跨域泛化等关键挑战。
Comments 12 pages, 9 figures
基于匹配场处理与源重定位观测的斯瓦尔巴群岛汉斯冰川表面冰裂缝演化
专题命中 工作流自动化 :workflow(abstract)
AI总结 提出结合匹配场处理与离散到时重定位的两步法,在有限仪器条件下实现米级分辨率冰川地震活动定位,揭示汉斯冰川表面冰裂缝传播速率与扩散系数。
Comments An edited version of this paper was published by AGU. Published 2026 American Geophysical Union. For supplementary materials please contact the authors. Citation will be added
UZH协议:分离误差并构建改进的CP2K基组和赝势
专题命中 工作流自动化 :workflow(abstract)
AI总结 提出UZH协议,通过三路比较分解CP2K中的高斯基组和赝势误差,并优化参数文件,从而改进基组和赝势。
鲁棒的人工智能驱动电子金属磷化物半导体发现
专题命中 工作流自动化 :workflow(abstract)
AI总结 结合生成式材料设计、机器学习原子间势和密度泛函理论,高通量筛选出3574种稳定磷化物,包括196种半导体,并识别出30种光电和26种热电候选材料。
Comments 46 pages, 5 main figures; Supporting Information included
q元覆盖码的形式化基础与携带证明的证书在Lean 4中
专题命中 工作流自动化 :workflow(abstract)
AI总结 本文在Lean 4中形式化了q元覆盖码的基础理论,包括汉明球体积公式、球覆盖下界等,并展示了端到端的工作流程以验证显式上界,贡献了一个可重用、可审计的机器校验覆盖码证书基础。
Comments 20 pages, no figures
通过EBRAINS研究基础设施统一冯·诺伊曼HPC与神经形态加速:高性能工作流框架
专题命中 工作流自动化 :workflow(abstract)
AI总结 提出基于EBRAINS JupyterLab的统一云工作流,支持用户透明地在冯·诺伊曼超算和神经形态硬件上执行脉冲神经网络,通过容器化和领域特定语言实现跨平台可重复性。
对抗性协同思考:HCI写作中多种GenAI工具的校准与三角验证
专题命中 工作流自动化 :workflow(abstract)
AI总结 本文探讨在学术论文起草阶段完全嵌入GenAI工具(Claude、ChatGPT、Gemini)的协作写作模式,提出“对抗性协同思考”方法:利用过往同行评审校准工具,并让工具输出相互对抗以测试而非盲从,强调评估能力而非生成能力是关键技能。
HGCAL硅传感器的质量控制与退火研究
专题命中 工作流自动化 :workflow(abstract)
AI总结 总结CMS HGCAL探测器未辐照硅传感器的质量控制结果,并首次对暴露于2×10¹⁵ n_eq/cm²的120μm外延传感器进行详细退火研究,提取Hamburg模型参数。
LLM即代码:面向Agent框架的编程范式
机构 * City University of Hong Kong(香港城市大学) ; Tencent Jarvis Lab(腾讯贾维斯实验室)
专题命中 软件智能体 :agentic(title,summary_cn);agent(title,title_cn);分类 cs.AI、cs.SE
AI总结 针对LLM作为编排器导致控制流幻觉和不可靠执行的问题,提出Agentic Programming范式,由程序控制所有流程,LLM仅作为代码组件在需要推理或生成时被调用,显著提升长序列操作的稳定性。
Comments Accepted at the KDD 2026 Workshop on Agentic Software Engineering (AgenticSE)
智能体事务:面向ACID兼容的智能体系统
专题命中 软件智能体 :agent(title,abstract);agentic(title,abstract);AI agent(abstract);tool use(abstract)
AI总结 该研究提出ACID兼容的智能体事务框架,开发对应数据智能体,在基准测试中较含Claude Code的现有智能体提升10.6%,为构建可信可扩展AI智能体开辟新方向。
Agentic Publication Protocol:科学出版现代化的一次尝试
机构 * Max-Planck-Institut für Quantenoptik(马克斯·普朗克量子光学研究所) ; Munich Center for Quantum Science and Technology(慕尼黑量子科学与技术中心) ; Leinweber Institute for Theoretical Physics(莱因韦伯理论物理研究所)
专题命中 软件智能体 :agentic(title,title_cn);agent(abstract);分类 cs.AI
AI总结 提出Agentic Publication Protocol(APP),一种将论文与代码、数据、环境信息及智能体指令打包的轻量级仓库格式,使未来研究者能直接使用操作知识。
Comments 16 pages, 5 figures and 1 table
MoCA-Agent: 一种用于金融和数值推理的声明市场代码智能体
机构 * University of Innsbruck(因斯布鲁克大学) ; University of British Columbia(不列颠哥伦比亚大学) ; Toronto Metropolitan University(多伦多都会大学)
专题命中 软件智能体 :agent(title,title_cn);multi-agent(abstract);分类 cs.AI
AI总结 提出MoCA-Agent,通过声明级验证和代码生成解决金融表格问答中的数值推理错误,在十个基准上取得强性能。
TDD-Agent:用于代码生成的测试驱动推理
专题命中 软件智能体 :agent(title,title_cn);分类 cs.AI、cs.SE
AI总结 TDD-Agent将测试驱动开发范式应用于代码生成,通过测试优先推理和迭代双轨优化,在LiveCodeBench和RepoEval上均优于相关基线,提升了代码及测试的有效性。
通过智能体轨迹剖析模型行为
机构 * AWS AI Labs(AWS人工智能实验室)
专题命中 软件智能体 :agent(title,summary_cn);AI agent(abstract);agentic(abstract);分类 cs.AI、cs.LG
AI总结 本文提出“意图-执行差距”概念,并设计Simple Strands Agent(SSA)框架,通过分析138k条轨迹揭示模型在自主问题解决中的行为差异。
Comments 106 pages, 50 Figures, 16 Tables
当错误成为叙事:生产级LLM Agent运行时中静默故障的纵向分类
机构 * Independent researcher(独立研究者)
专题命中 软件智能体 :agent(title,title_cn);分类 cs.AI、cs.SE
AI总结 通过八周对生产级个人助手Agent运行时的研究,识别出28次静默故障,提出五类机制导向分类,其中D类(链式幻觉与捏造)为LLM特有且最危险,系统会生成流畅可信的虚假叙事。
Comments 18 pages, 5 figures, 2 tables. 22 incident postmortems and all defense-framework artifacts publicly available at https://github.com/bisdom-cell/openclaw-model-bridge; governance engine on PyPI (openclaw-ontology-engine)
从解剖到气味:Agent技能中SKILL.md的实证研究
专题命中 软件智能体 :agent(title,title_cn);分类 cs.SE
AI总结 对238个真实Agent技能的SKILL.md文件进行定性分析,构建语义组件分类法,通过多源文献综述识别最佳实践并定义技能气味,开发自动检测器发现超过99%的文件存在气味且难以消除。
责任归属:在智能体软件开发中将人类责任映射到工作流制品
专题命中 软件智能体 :workflow(title,abstract);agentic(title,abstract);agent(abstract);分类 cs.SE
AI总结 该研究分析智能体软件开发中责任归属的矛盾,替换验证分类法,发现责任归属方向相反,指出智能体工具未造成责任差距,相关数据已公开。
Comments 30 pages, 5 tables. Source collection of 118 archived documents and 12 processing scripts deposited at Zenodo, doi:10.5281/zenodo.21965182
智能体编码时代人机协作的工程信号:对vLLM和SGLang中33228个拉取请求的纵向分析及其对生物医学智能体和生物信息学流程开发的启示
专题命中 软件智能体 :agentic(title,abstract);AI agent(title);autonomous agent(abstract);分类 cs.AI、cs.LG、cs.SE
AI总结 该研究对vLLM和SGLang的33228个拉取请求进行纵向分析,发现AI辅助开发提升了开源软件的吞吐量、贡献者参与度及人机协作信号,且增长主要由人类驱动,为生物医学智能体开发提供启示。
Comments 24 pages, 9 Figures
迈向工业中人工智能代理创建民主化的持续保障
专题命中 软件智能体 :agent(title,abstract);AI agent(title,abstract);分类 cs.AI
AI总结 针对工业中人工智能代理创建民主化带来的可靠性挑战,提出轻量级持续保障框架,结合依赖映射等多种方法评估代理运行状态,还展示了原型审核器及评估,为公民创建的组织代理提供保障。
GitHub上的AI代理拉取请求:频率、结构和合并冲突率
专题命中 软件智能体 :agent(title,abstract);AI agent(title,abstract);分类 cs.SE
AI总结 利用AIDev-pop数据集对AI代理编写的拉取请求并发情况进行大规模实证分析,发现特定时间重叠下部分仓库有协同活动的请求对,多数为同一代理,还研究了合并冲突率及冲突类型。
Comments 7 pages, 4 figures, 2 tables. Replication package: https://doi.org/10.5281/zenodo.21186464
智能体数据注入攻击对人工智能智能体构成现实威胁
机构 * Seoul National University(首尔国立大学) ; Largosoft ; University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
专题命中 软件智能体 :agent(title,abstract);AI agent(title,abstract);分类 cs.AI
AI总结 介绍智能体数据注入攻击(ADI)这一新型间接提示注入,其伪装可信数据注入恶意数据使智能体执行意外操作,研究发现现实智能体漏洞及ADI在多种模型和智能体设置中有效,揭示智能体安全关键差距。
Comments 19 pages, 19 figures, 7 tables