arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-07-09 至 2026-07-09 共收录 156 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工作流自动化 26 篇

2607.06873 2026-07-09 cs.SE 新提交 83%

Mining Workflow Graphs for Black-Box Boundary Testing of Conversational LLM Agents

挖掘工作流图用于对话式大语言模型代理的黑盒边界测试

Liting Lin, Boxi Yu, Yuzhong Zhang, Lionel Briand, David-Paul Niland, Emir Muñoz

专题命中 工作流自动化 :workflow(title,abstract);agent(abstract);分类 cs.SE

AI总结 研究针对对话式大语言模型代理内部工作流失败难测问题,提出黑盒测试框架AgentEval,通过挖掘对话工作流图,利用其结构枚举测试目标,执行测试,在与白盒审计器对比测试中,能有效覆盖多个不同边界,降低重复率和误报率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07109 2026-07-09 cs.CR 新提交 82%

Certifying Ghosts: How Cybersecurity AI Agents Break the EU Cyber Resilience Act

认证幽灵:网络安全人工智能代理如何突破欧盟网络弹性法案

Víctor Mayoral-Vilches

专题命中 工作流自动化 :AI agent(title);agent(abstract);agentic(abstract)

AI总结 研究欧盟网络弹性法案在网络安全人工智能代理冲击下的问题,指出其四点假设被打破,法案应对方式有矛盾,提出应转向持续且由代理操作的安全模式,并通过机器人实验验证补救措施。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06569 2026-07-09 q-bio.QM cs.LG 新提交 79%

Towards a Pseudo-Labeling Workflow for Celltype-Classification from Explanted Brain Slice Recordings

迈向用于从离体脑切片记录中进行细胞类型分类的伪标签工作流程

Cora Jostock, Jonas Ort, Henner Koch, Gregor Schiele, Andreas Erbslöh

机构 * RWTH University Hospital, Department of Neurosurgery(RWTH大学医院神经外科部门) RWTH University Hospital, Department of Epileptology(RWTH大学医院癫痫学部门) University of Duisburg-Essen, Intelligent Embedded Systems Lab(杜伊斯堡-埃森大学智能嵌入式系统实验室)

专题命中 工作流自动化 :workflow(title,abstract);分类 cs.LG

AI总结 该研究针对人脑切片MEA记录的细胞外尖峰分类问题,提出无监督工作流程,涵盖数据预处理、机器学习降维聚类等,考虑在线系统方法,通过多种指标评估管道,严格策展可提高分离度。

Comments 4 pages, 5 figures, Biomedizische Technik 2026 (accepted)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07676 2026-07-09 cs.AI 新提交 79%

SkillCenter: A Large-Scale Source-Grounded Skill Library for Autonomous AI Agents

SkillCenter:用于自主人工智能代理的大规模源基础技能库

Tianming Sha, Yue Zhao, Lichao Sun, Yushun Dong

机构 * Stony Brook University(纽约州立大学石溪分校) University of Southern California(南加州大学) Lehigh University(里海大学) Florida State University(佛罗里达州立大学)

专题命中 工作流自动化 :AI agent(title,abstract);分类 cs.AI

AI总结 研究针对自主AI代理缺乏扎实操作知识的问题,构建SkillCenter技能库,通过多源获取等端到端框架,集成大量源基础和社区技能,实现技能可追溯,以保障代理输出的正确性、安全性和可维护性。

Comments 44 pages, 5 figures. Code: https://github.com/LabRAI/SkillCenter ; Data: https://huggingface.co/datasets/Tommysha/skillcenter-bundles

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07007 2026-07-09 cs.CR cs.SE 新提交 79%

Thinking More, Harnessing Better: State Machine Guided Harness Automatic Generation with Project Digestion and Workflow Decomposition

思考更多,利用更好:通过项目剖析和工作流分解实现状态机引导的测试 harness 自动生成

Xing Zhang, Zikang Huang, Gang Yang, CongChong Wang, Lu Liu, Bin Yin, Mingyi Wang, Ziquan Zhao, Min Li, Zhenyu Chen, Bo Wu, Lingyun Ying

专题命中 工作流自动化 :workflow(title,abstract);分类 cs.SE

AI总结 研究针对现有大语言模型单轮生成模糊测试 harness 的局限,提出 SynapseFlow,通过数据流感知函数聚合和分阶段回滚算法,经四阶段过程合成 harness,在 25 个开源项目上评估,效果超现有工具,还发现多个未报告错误。

Comments 20 pages, accepted by CCS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06786 2026-07-09 cs.NI cs.AI 新提交 79%

From Agentic to Autogenic Network Management for AI-Native 6G and Beyond: A Standards Perspective

从智能到自生的网络管理:面向原生人工智能的6G及以后网络——标准视角

Petar Djukic, Sudipta Acharya, Takai Eddine Kennouche, Burak Kantarci

机构 * Bell Labs Research(贝尔实验室研究部) Nokia Technology Standards(诺基亚技术标准) University of Ottawa(Ottawa大学)

专题命中 工作流自动化 :agentic(title,abstract);分类 cs.AI

AI总结 研究面向6G及以后网络的网络管理,提出自生网络管理参考架构,通过自我编程等能力扩展智能能力,支持分阶段部署,经高优先级运营商场景展示可应对实际挑战,给出使自生网络管理在未来6G网络实现的研究路线图。

Comments 9 pages, 5 figures, Accepted to IEEE Network

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06076 2026-07-09 cs.HC 新提交 78%

Designing Computerized Gait Analysis for Pediatric Care: Clinician Perspectives on Sensing, Workflow, and Care Environments

为儿科护理设计计算机化步态分析:临床医生对传感、工作流程和护理环境的看法

Elizabeth Hong, Andrea Green, Ge Wang, Yiwen Dong

专题命中 工作流自动化 :workflow(title,abstract)

AI总结 研究围绕如何为儿科护理设计计算机化步态分析,通过对儿科临床医生等的定性研究,明确儿童相关挑战、工作流程需求等,进而给出以儿科为中心的CGA设计建议,助力临床技术适应儿科需求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29033 2026-07-09 cs.IR 版本更新 75%

Human-in-the-Loop Nugget Annotation for Accountable LLM-as-a-Judge Evaluations

人在环路的金块标注:用于可问责的LLM作为评判者评估

Laura Dietz

专题命中 工作流自动化 :agent(abstract_cn);workflow(abstract);agentic(abstract)

AI总结 提出一种原型标注工具,通过人类识别信息金块、LLM进行匹配的分工方式,实现高效且可问责的AI系统评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07094 2026-07-09 cs.SE cs.AI 新提交 62%

MetaConfigurator: AI-Assisted RDF Authoring from JSON Data

MetaConfigurator:从JSON数据实现AI辅助的RDF创作

Felix Neubauer, Mahdi Jafarkhani, Kenichi Endo, Jürgen Pleiss, Benjamin Uekermann

机构 * Institute for Parallel and Distributed Systems, University of Stuttgart(并行与分布式系统研究所,斯图加特大学) Institute of Polymer Chemistry, University of Stuttgart(聚合化学研究所,斯图加特大学) Institute of Biochemistry, University of Stuttgart(生物化学研究所,斯图加特大学)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI、cs.SE

AI总结 提出一个集成AI辅助的RML映射、SPARQL查询和知识图谱可视化的Web界面,将JSON等结构化数据转换为RDF,并以MOF合成实验数据验证其有效性。

Comments Submitted as post-proceedings for the deRSE26 conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06802 2026-07-09 eess.SP cs.AI 新提交 57%

A Multi-Analyst LLM Pipeline for Auditable Rule Discovery Across 68 Public Physiological Corpora

用于跨68个公共生理语料库进行可审计规则发现的多分析师大语言模型管道

Dovy Paukstys

机构 * Komori Care, LLC(科莫里护理公司)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 针对开放生理语料库异质性无法确定新监测平台探测器规则的问题,提出多分析师大语言模型工作流程,通过读取语料库文档、去重、审核、整合等操作,产生可审计规则形状库及探测器组件,推动文献规则向硬件验证发展。

Comments 8 pages, 2 figures, 9 tables; submitted to IEEE SPMB 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07521 2026-07-09 cs.HC cs.AI 新提交 57%

Creativity from Friction: Human-AI Interaction for Exploratory Structural Design

摩擦产生创造力:用于探索性结构设计的人机交互

Ricardo Maia Avelino, Rita Sevastjanova, Tom Van Mele, Philippe Block, Mennatallah El-Assady

机构 * Block Research Group, Department of Architecture, ETH Zurich(建筑系,苏黎世联邦理工学院) IVIA Lab, Department of Computer Science, ETH Zurich(计算机科学系,苏黎世联邦理工学院)

专题命中 工作流自动化 :AI agent(abstract);分类 cs.AI

AI总结 探讨当前生成式AI目标与结构设计师等创作者需求的偏差,提出允许受限人机共同创作的系统设计维度,通过试点设计界面和专家研究,展示其对设计空间探索的支持及设计师看法。

Comments Accepted at ICML 2026, Workshop on Human-AI Co-Creativity

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07504 2026-07-09 cs.AI 新提交 57%

Do LLM-Generated Skills Make Better AI Data Scientists? A Component Ablation Across Data-Science Workflows

大语言模型生成的技能能否造就更好的人工智能数据科学家?跨数据科学工作流程的组件消融

Wei-Jung Huang

机构 * Independent Researcher(独立研究者)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 研究大语言模型生成的技能在数据科学工作流程中的作用,通过在四个阶段测试及组件消融实验发现,完整生成技能及消融后的技能变体与任务单独提示相比,均未显著提升性能,提醒勿将其作为默认单次提示策略。

Comments KDD 2026 Workshop on AI Data Scientist

Journal ref KDD 2026 Workshop on AI Data Scientist

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06919 2026-07-09 cs.CV cs.LG 新提交 57%

Compass: Prostate Cancer Detection Needs Multi-View Context

Compass:前列腺癌检测需要多视图上下文

Paul F. R. Wilson, Mohamed Harmanani, Zhuoxin Guo, Obed K. Dzikunu, Hannes Cash, Adam Kinnaird, Brian Wodlinger, Purang Abolmaesumi, Parvin Mousavi

机构 * Queen’s University(女王大学) University of British Columbia(英属哥伦比亚大学) Otto von Guericke University Magdeburg(马格德堡奥托·冯·格里克大学) University of Alberta(阿尔伯塔大学) Exact Imaging(精准成像公司) Vector Institute(向量研究所)

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 研究针对前列腺癌检测,提出Compass方法,整合多视图信息,通过基于探头旋转角度的变压器聚合证据,经多中心数据集训练评估,性能强大,凸显多视图上下文价值,为PCa诊断提供有力工具。

Comments MICCAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29251 2026-07-09 cs.AI q-fin.CP 版本更新 57%

When Summaries Distort Decisions: Information Fidelity in LLM-Compressed Financial Analysis

当摘要扭曲决策:LLM压缩财务分析中的信息保真度

Hoyoung Lee, Suhwan Park, Seunghan Lee, Jun Seo, Jaehoon Lee, Sungdong Yoo, Minjae Kim, CheolWon Na, Zhangyang Wang, Zach Golkhou, Minkyu Kim, Sotirios Sabanis, Alejandro Lopez-Lira, Dhagash Mehta, Soonyoung Lee, Chanyeol Choi, Wonbin Ahn, Yongjae Lee

机构 * UNIST(全纳科学技术大学) LG AI Research(LG人工智能研究) Sungkyunkwan University(成均馆大学) University of Texas at Austin(德克萨斯大学奥斯汀分校) J.P. Morgan Chase(摩根大通) State Street(州立银行) University of Edinburgh(爱丁堡大学) University of Florida(佛罗里达大学) BlackRock(黑石) LinqAlpha

专题命中 工作流自动化 :agentic(abstract);分类 cs.AI

AI总结 研究LLM压缩财务信息时因丢失决策相关上下文导致投资判断改变的问题,提出通过生成多个候选压缩并审计分歧的代理上下文压缩方法。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23990 2026-07-09 cs.CY cs.AI 57%

From Untamed Black Box to Interpretable Pedagogical Orchestration: The Ensemble of Specialized LLMs Architecture for Adaptive Tutoring

从混沌黑箱到可解释的教育编排:专精LLM集合架构用于自适应辅导

Nizam Kadir

机构 * Singapore University of Technology and Design(新加坡科技设计大学)

专题命中 工作流自动化 :agent(abstract);分类 cs.AI

AI总结 本文提出ES-LLMS架构,通过分离决策与表达,利用可解释的BKT模型协调专精代理,提升辅导系统的可控性和可靠性,实验显示其在指导与信任方面优于传统模型。

Comments Accepted as a FULL paper at the 27th International Conference on Artificial Intelligence in Education (AIED 2026). 15 pages, 4 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17057 2026-07-09 physics.flu-dyn cs.LG cs.NE math.OC 版本更新 57%

Optimization-Embedded Active Multi-Fidelity Surrogate Learning for Multi-Condition Airfoil Shape Optimization

嵌入优化的主动多保真度代理学习用于多条件机翼形状优化

Isaac Robledo, Alberto Vilariño, Arnau Miró, Oriol Lehmkuhl, Carlos Sanmiguel Vila, Rodrigo Castellanos

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 本文提出一种嵌入优化的主动多保真度代理学习方法,用于多条件机翼形状优化,通过低保真度模型和高保真度模拟的结合,减少计算流体力学成本并保持RANS精度。

Comments 24 pages, 18 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06775 2026-07-09 hep-ex 新提交 50%

Data Preservation in High Energy Physics: Global Report 2026

高能物理中的数据保存:2026年全球报告

Matthew Bellis, Jamie Boyd, Daniel Britzger, Andy Buckley, Chris Burr, Micheal Buchar, Gang Chen, Andrew Chisholm, Jiri Chudoba, Michael Davis, Cristinel Diaconu, David Dobrigkeit Chinellato, Marcus Ebert, Apranik Fatehi, Dillon S. Fitzgerald, Jose Benito Gonzalez Lopez, Richard William Gran, Giovanni Guerrieri, Martin Habedank, Hao Hu, David Horvat, Luka Lambrecht, Clemens Lange, Kati Lassila-Perini, Jerome Lauret, Jean-Yves Le Meur, Dietrich Liko, Panna Liptak, Zach Marshall, Thomas McCauley, Cameron Duncan McClymont, Wesley Middelbos, Micha Moskovic, Piet Nogga, Ryunosuke O'Neil, Stefano Piano, Alan Price, Tomasz Procter, Fazhi Qi, Diana Rand, Hossein Rashidi, Emily Rensch, Pablo Saiz, Ulrich Schwickerath, Tibor Šimko, Andrii Verbytskyi, Dirk Zerwas, Zhengde Zhang, Graham Wilson

专题命中 工作流自动化 :workflow(abstract)

AI总结 该报告总结2026年DPHEP研讨会贡献,反映高能物理数据保存进展、挑战与趋势,包括遗留数据复兴、可持续性问题,创新项目进步,转向自动化,以及开放科学势头增强等情况。

Comments 59 pages; 35 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06909 2026-07-09 cs.CV 新提交 50%

Seeing What Matters: Lesion-Aware High-Resolution Patch Discovery and Fusion for Chest X-ray Report Generation

看清关键所在:用于胸部X光报告生成的病灶感知高分辨率补丁发现与融合

Yingshu Li, Yunyi Liu, Zhenghao Chen, Tong Chen, Zailong Chen, Lingqiao Liu, Lei Wang, Luping Zhou

机构 * The University of Sydney(悉尼大学) The University of Newcastle(纽卡斯尔大学) University of Wollongong(卧龙岗大学) The University of Adelaide(阿德莱德大学)

专题命中 工作流自动化 :workflow(abstract)

AI总结 研究针对胸部X光报告生成中高分辨率感知难题,提出LePaX框架。该框架将高分辨率感知设为固定令牌预算下的空间分辨率分配问题,通过可学习空间分辨率分配和全局-区域融合两个组件,在不增令牌数时实现高分辨率CXR感知,提升了临床和语言指标。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06589 2026-07-09 cs.SD 新提交 50%

Extending Xenakis: From Architectural Geometry to Sonification of the Philips Pavilion

扩展克赛纳基斯:从建筑几何到飞利浦展馆的声波化

Changda Ma, Sunshiyu Wang, Canting Zhu, Alexandria Smith

专题命中 工作流自动化 :workflow(abstract)

AI总结 该研究重新审视克赛纳基斯的转换,颠倒工作流程将飞利浦展馆声波化。通过重建展馆为直纹面,提取母线和采样点,用Python实现系统生成MIDI并可视化,为建筑几何转化为可演奏音乐结构铺路,扩展其音乐思维至声波化等实践。

Comments Accepted to the International Computer Music Conference (ICMC) 2026

Journal ref Proceedings of the 51st International Computer Music Conference (ICMC 2026), Hamburg, Germany, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07131 2026-07-09 physics.chem-ph 新提交 50%

Plasmonic Cavity Quantum Dynamics under Linear Vibronic Coupling

线性振动耦合下的等离子体腔量子动力学

Mohammad Shams, Kimia Kargar, David Mendive-Tapia, Fatemeh Khalili, Oriol Vendrell, Zahra Jamshidi

专题命中 工作流自动化 :workflow(abstract)

AI总结 针对等离子体激发量子动力学建模的挑战,引入基于线性振动耦合模型的厄米形式,结合第一性原理计算和机器学习技术,通过Python Plasmonic Cavity平台参数化,有效再现实验光谱并研究了等离子体状态布居动力学。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03208 2026-07-09 cond-mat.mtrl-sci quant-ph 新提交 50%

Data-driven multi-objective optimization for alloy recycling using factorization machines and quantum annealing

使用因子分解机和量子退火进行合金回收的数据驱动多目标优化

Thomas Plehn, Katrin Bugelnig, Silvana Tumminello, Daniel Barragan-Yani, David Melching

专题命中 工作流自动化 :workflow(abstract)

AI总结 研究通过因子分解机和量子退火工作流程对金属升级循环中多目标帕累托优化的应用,采用数据驱动切比雪夫标量化方案,结果表明该流程扩展了基于QUBO优化的适用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15667 2026-07-09 cs.CV 新提交 50%

CEVAR: Centerline Embedding Extraction for Endovascular Aneurysm Repair

CEVAR:用于血管内动脉瘤修复的中心线嵌入提取

Roman Naeem, Timo Niiniskorpi, Charlotte Sandström, Naman Desai, Anders Jeppsson, Ida Häggström, Fredrik Kahl, Håkan Roos, Jennifer Alvén

机构 * Chalmers University of Technology(查尔姆斯理工大学) The University of Gothenburg(哥德堡大学) Sahlgrenska University Hospital(萨尔拉格斯卡大学医院)

专题命中 工作流自动化 :workflow(abstract)

AI总结 针对EVAR术后密封区失效导致的破裂问题,提出一种结合3D中心线追踪与嵌入几何预测的Transformer框架,实现自动密封区评估,在常规及无对比剂CT上均优于半自动方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.19887 2026-07-09 cs.DC cs.MA cs.RO cs.SY eess.SY 版本更新 50%

DAG-Based QoS-Aware Dynamic Task Placement for Networked Multi-Stage Control Pipelines

基于DAG的QoS感知动态任务放置用于网络化多阶段控制流水线

Thien Tran, Jonathan Kua, Thuong Hoang, Minh Tran, Yuemin Ding, Jiong Jin

机构 * Deakin University, Australia(德坎大学,澳大利亚) RMIT University, Vietnam(皇家墨尔本理工大学,越南) University of Navarra, Spain(纳瓦拉大学,西班牙) Swinburne University of Technology, Australia(斯威本科技大学,澳大利亚)

专题命中 工作流自动化 :planning(abstract)

AI总结 本文提出一种基于DAG的QoS感知动态任务放置框架,用于网络化机器人中的感知-感知-规划-控制流水线,通过动态任务放置优化计算、通信延迟和任务放置集,解决传统静态边缘卸载和单阶段模型的不足。

Comments 5 pages, 1 figure, 1 table, 1 algorithm, accepted paper on the 24th IEEE International Conference on Industrial Informatics (INDIN), 26-29 July, 2026, Melbourne, Australia

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 软件智能体 9 篇

2607.07593 2026-07-09 cs.SE 新提交 86%

What Makes a Good Bug Report for an AI Agent?

什么是适合人工智能代理的优质错误报告?

Lara Khatib, Noble Saji Mathews, Meiyappan Nagappan, Pengyu Nie, Thomas Zimmermann

专题命中 软件智能体 :agent(title,abstract);AI agent(title);分类 cs.SE

AI总结 研究自动化程序修复代理的优质错误报告,通过统计建模和受控消融分析发现,代理受益于具体可执行且定位好的信息,与人类优质报告有别,如自然语言重现步骤等对代理作用不大,不同模型处理缺失信息方式有差异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07474 2026-07-09 cs.CR cs.AI cs.CL 新提交 84%

Beyond Attack-Success Rate: Action-Graded Severity Scale for Tool-Using AI Agents

超越攻击成功率:工具使用型人工智能代理的行动分级严重程度量表

Harry Owiredu-Ashley

专题命中 软件智能体 :AI agent(title);agent(abstract);agentic(abstract);分类 cs.AI、cs.CL

AI总结 研究指出代理红队测试基准的二元攻击成功率不能体现行动危害。为此引入行动分级伤害准则,通过预言机和评判小组计算量表。在AgentDojo工作区测试发现该准则能揭示新情况,虽与预言机一致性高但有盲点,贡献了可用于红队日志实际行动的严重程度工具。

Comments 8 pages, 6 figures. Code and artifacts: https://github.com/Harry-Ashley/action-graded-severity

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11950 2026-07-09 cs.SE cs.AI cs.CL cs.CR 版本更新 80%

AnyPoC: Universal Proof-of-Concept Test Generation for Scalable LLM-Based Bug Detection

AnyPoC:用于可扩展LLM基于Bug检测的通用证明-概念测试生成

Zijie Zhao, Chenyuan Yang, Weidong Wang, Yihan Yang, Ziqi Zhang, Lingming Zhang

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 软件智能体 :agent(abstract);agentic(abstract);multi-agent(abstract);分类 cs.AI、cs.CL、cs.SE

AI总结 AnyPoC通过多代理框架生成可执行的证明-概念测试,以验证候选Bug报告,提升自动化Bug检测的实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07433 2026-07-09 cs.CR 新提交 79%

Beware of Agentic Botnets: Scalable Untargeted Promptware Attacks via Universal and Transferable Adversarial HalluSquatting

警惕智能体僵尸网络:通过通用且可转移的对抗性幻觉蹲点进行可扩展的无目标提示软件攻击

Aya Spira, Stav Cohen, Elad Feldman, Ron Bitton, Avishai Wool, Ben Nassi

专题命中 软件智能体 :agentic(title,abstract)

AI总结 研究针对实际威胁模型中无直接渠道时攻击者能否利用LLM应用的问题,提出对抗性幻觉蹲点技术,通过识别热门资源计算幻觉分布抢先注册对抗性提示,利用幻觉特性扩大无目标提示软件攻击范围并建立僵尸网络,实验证明该技术可行性及幻觉可转移性。

Comments Website: https://sites.google.com/view/agentic-botnets/home

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07696 2026-07-09 cs.DB cs.AI 新提交 74%

Breaking Database Lock-in: Agentic Regeneration of High Performance Storage Readers for Database Bypass

打破数据库锁定:用于数据库绕过的高性能存储读取器的智能再生

Victor Giannakouris, Immanuel Trummer

机构 * Cornell University(康奈尔大学)

专题命中 软件智能体 :agentic(title);分类 cs.AI

AI总结 研究分析工作负载面临的数据访问瓶颈问题,提出Jailbreak方法,利用大语言模型辅助代码合成绕过数据库引擎直接读取存储文件,在PostgreSQL和MySQL上评估,性能显著提升,证明该方法可打破数据库系统数据锁定。

Comments To be presented at AIDB 2026 (co-located with VLDB)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07235 2026-07-09 cs.LG cs.AI cs.SE 新提交 67%

ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies

ORCAID:用于深度强化学习策略的基于斜规则的连续动作解释

Ignacio D. Lopez-Miguel, Ezio Bartocci, Thomas Eiter, Martin Tappler

机构 * TU Wien(维也纳技术大学)

专题命中 软件智能体 :agent(abstract);分类 cs.AI、cs.LG、cs.SE

AI总结 针对强化学习中连续动作空间下可解释性难题,提出ORCAID方法,通过高效斜决策树训练算法,经三阶段分割搜索提取基于规则的可解释策略,在多环境评估中表现良好,能保持性能并提升原深度强化学习策略。

Comments 33 pages, 8 figures, accompanying source code available at https://gitlab.tuwien.ac.at/ignacio.lopez/ORCAID

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01043 2026-07-09 cs.SE 版本更新 57%

DPO-F+: Aligning Code Repair Feedback with Developers' Preferences

DPO-F+:使代码修复反馈与开发者偏好对齐

Zihan Fang, Yifan Zhang, Yueke Zhang, Kevin Leach, Yu Huang

专题命中 软件智能体 :workflow(abstract);分类 cs.SE

AI总结 研究针对大语言模型在代码修复中开发者难解读输出的问题,提出DPO-f+框架,通过定义指标、构建数据集、微调模型及评估反馈质量,提升反馈准确性与对齐度,增强了代码理解和人机协作。

Comments 10 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏