arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-06-25 至 2026-06-25 共收录 153 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工作流自动化 20 篇

2606.25980 2026-06-25 cs.SD 新提交 50%

FoleySet: A Multi-Level Human-Annotated Foley Sound Dataset

FoleySet: 一个多层级人工标注的拟音音效数据集

Sunshiyu Wang, Alexander Lerch

专题命中 工作流自动化 :workflow(abstract)

AI总结 为解决拟音数据稀缺问题,构建了包含10,000个音频片段、具有两级拟音分类体系的数据集FoleySet,用于分类、检索和生成任务。

Comments Accepted to the International Conference on Digital Audio Effects (DAFx 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25837 2026-06-25 cs.DL 新提交 50%

Towards an Interactive Evidence-RAG Peer-Review Workspace for the Journal of Digital History

面向《数字历史期刊》的交互式证据RAG同行评审工作空间

Elisabeth Guerard, Mehrdad Almasi, Marion Salaun, Frederic Clavert, Mirjam Pfeiffer

专题命中 工作流自动化 :workflow(abstract)

AI总结 提出一个交互式证据RAG工作空间,用于《数字历史期刊》的AI辅助同行评审编辑评估,通过链接评论、证据、检索痕迹和可重复性检查提高模型建议的可检查性,初步评估显示严格准确率70.0%,有用输出率90.0%。

Comments Preliminary version of a full paper. 9 pages, 1 figure, 5 tables. Associated with an accepted presentation at AI through History, History through AI, C2DH, University of Luxembourg, 15-16 June 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24895 2026-06-25 cs.DL 新提交 50%

Hybrid Metadata Extraction from League of Nations Index Cards: From Feasibility Study to Archival System Integration

国联索引卡片的混合元数据提取:从可行性研究到档案系统集成

Florian Cafiero, Grégoire Mallard

专题命中 工作流自动化 :workflow(abstract)

AI总结 提出混合AI工作流从国联索引卡片中提取并整合档案元数据,结合YOLO、TrOCR、本地LLM后校正及微调视觉语言模型,实现从布局感知管道到混合架构的演进。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25682 2026-06-25 physics.soc-ph cs.SI math.DS 新提交 50%

Opinion Dynamics over Migration Networks

迁移网络上的意见动力学

Lőrinc Márton, Stefanie Winkelmann, Mauricio J. del Razo, Nataša Djurdjevac Conrad

专题命中 工作流自动化 :agent(abstract)

AI总结 提出一个耦合局部意见转变、人口过程和社区间迁移的随机框架,通过时空主方程描述,推导确定性平均场方程,揭示随机性和迁移如何定性改变共识、极化等集体结果。

Comments 30 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25026 2026-06-25 astro-ph.GA 新提交 50%

WaveDM.jl: An Adaptable Simulation Framework for Dynamics of Baryonic and Wave Dark Matter on Galaxy Scales

WaveDM.jl:星系尺度上重子和波暗物质动力学的自适应模拟框架

Runyu Meng, Xiaobo Dong

专题命中 工作流自动化 :workflow(abstract)

AI总结 提出一个开源Julia包WaveDM.jl,采用伪谱傅里叶方法求解薛定谔-泊松方程,结合N体引力求解器,实现星系尺度上波暗物质与重子组分的协同演化,支持多级并行和用户友好工具。

Comments Submitted. Comments welcome

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09661 2026-06-25 physics.ao-ph nlin.AO physics.data-an stat.ME 版本更新 50%

Alternate states and intermingledness in complex high-dimensional systems

复杂高维系统中的交替态与交织性

George Datseris, Johannes Lohmann, Oisín Hamilton, Jacob Haqq-Misra

专题命中 工作流自动化 :workflow(abstract)

AI总结 利用计算非线性动力学方法,提出一种工作流自动识别高维模拟数据中的交替态,并定义交织性指标量化其差异与相似性,应用于气候系统分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29591 2026-06-25 cs.CV 版本更新 50%

FlowID : Enhancing Forensic Identification with Latent Flow-Matching Models

FlowID: 利用潜在流匹配模型增强法医鉴定

Jules Ripoll, David Bertoin, Alasdair Newson, Charles Dossal, Jose Pablo Baraybar

机构 * INSA Toulouse(图卢兹理工学院) La Sorbonne Université(索邦大学) International Committee of the Red Cross(国际红十字委员会)

专题命中 工作流自动化 :workflow(abstract)

AI总结 提出FlowID方法,结合单图像微调与注意力掩码,修复暴力死亡面部损伤并保留身份特征,在InjuredFaces基准上优于现有开源方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05354 2026-06-25 cs.CV cs.GR 版本更新 50%

SplatPainter: Interactive Authoring of 3D Gaussians from 2D Edits via Test-Time Training

SplatPainter: 通过测试时训练从2D编辑交互式创作3D高斯

Yang Zheng, Hao Tan, Kai Zhang, Peng Wang, Leonidas Guibas, Gordon Wetzstein, Wang Yifan

机构 * Stanford University(斯坦福大学) Adobe

专题命中 工作流自动化 :workflow(abstract)

AI总结 提出SplatPainter,一种状态感知的前馈模型,通过测试时训练实现从用户2D视图连续编辑3D高斯资产,支持局部细节优化、涂改和全局重着色,达到交互速度。

Comments project page https://y-zheng18.github.io/SplatPainter/

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.07920 2026-06-25 eess.IV cs.CV 版本更新 50%

ArteryX: A Reliable End-to-End Toolbox for Standardized Intracranial Artery Feature Extraction from 3D TOF-MRA

ArteryX:用于从3D TOF-MRA中标准化颅内动脉特征提取的可靠端到端工具箱

Abrar Faiyaz, Nhat Hoang, Giovanni Schifitto, Md Nasir Uddin

机构 * Department of Neurology, University of Rochester(罗切斯特大学神经科部) Department of Physics, University of Rochester(罗切斯特大学物理系) Department of Imaging Sciences, University of Rochester(罗切斯特大学影像科学系) Department of Electrical & Computer Engineering, University of Rochester(罗切斯特大学电气与计算机工程系) Department of Biomedical Engineering, University of Rochester(罗切斯特大学生物医学工程系)

专题命中 工作流自动化 :workflow(abstract)

AI总结 提出ArteryX工具箱,通过标准化动脉分类、集成分割处理和图构建,提取形态、拓扑和复杂性特征,在三个数据集上验证其优于iCafe,并降低人工校正负担。

Comments 26 Pages, 6 Figures, Preliminary version of the toolbox was presented at the ISMRM 2025 Conference in Hawaii at the "Software Tools" Session

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 软件智能体 11 篇

2509.06216 2026-06-25 cs.SE cs.AI 版本更新 84%

Agentic Software Engineering: Foundational Pillars and a Research Roadmap

代理软件工程:基础支柱与研究路线图

Ahmed E. Hassan, Hao Li, Dayi Lin, Bram Adams, Tse-Hsun Chen, Yutaro Kashiwa, Dong Qiu

机构 * Queen's University(女王大学) Concordia University(Concordia大学) Nara Institute of Science and Technology(奈ara科学和技术研究院) Huawei Canada(华为加拿大)

专题命中 软件智能体 :agentic(title,abstract);agent(abstract);分类 cs.AI、cs.SE

AI总结 提出代理软件工程(SE 3.0)时代,以“面向人类的SE”和“面向代理的SE”双重模式为基础,重新定义软件工程支柱,并设计代理命令环境(ACE)和代理执行环境(AEE)两种工作台,实现双向人机协作,推动从代理编码到真正代理软件工程的演进。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29919 2026-06-25 cs.SE 版本更新 79%

SkillReducer: Optimizing LLM Agent Skills for Token Efficiency

SkillReducer: 优化LLM代理技能的令牌效率

Yudong Gao, Zongjie Li, Yuanyuan Yuan, Zimo Ji, Pingchuan Ma, Shuai Wang

专题命中 软件智能体 :agent(title,abstract);分类 cs.SE

AI总结 针对LLM代理技能中令牌浪费问题,提出SkillReducer两阶段优化框架,通过压缩路由描述和重构技能主体,实现48%描述压缩和39%主体压缩,同时提升功能质量2.8%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24965 2026-06-25 cs.AI cs.LG 新提交 73%

Project Auto-World: Towards Automated Benchmarking of Neural Relational Reasoners

Project Auto-World: 迈向神经关系推理器的自动化基准测试

Anirban Das, Joanne Boisson, Irtaza Khalid, Sumita Garai, Steven Schockaert

机构 * Cardiff University(卡迪夫大学) University of Pennsylvania(宾夕法尼亚大学)

专题命中 软件智能体 :autonomous agent(abstract);agentic(abstract);分类 cs.AI、cs.LG

AI总结 利用大语言模型自动化生成基准测试实例,通过进化搜索和自主代理搜索发现困难样本,提升Edge Transformer的泛化能力,并应用于新世界以推动神经关系推理的自主研究。

Comments Submitted to NeurIPS 2026 E&D track. Code is available at https://github.com/autoworldrules/auto-world-rules

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15834 2026-06-25 cs.AI cs.CR cs.SY eess.SY 新提交 70%

AIChilles: Automatically Uncovering Hidden Weaknesses in AI-Evolved Systems

AIChilles:自动发现AI进化系统中的隐藏弱点

Yajie Zhou, Ao Li, Ashwin Silla, Zaoxing Liu, Vyas Sekar

机构 * Carnegie Mellon University(卡内基梅隆大学) Boston University(波士顿大学)

专题命中 软件智能体 :agent(abstract);AI agent(abstract);分类 cs.AI

AI总结 提出AIChilles框架,通过结合确定性工作负载参数提取、基于代理的约束推断、差异预言机和代码频率覆盖,自动发现AI进化程序在正确性、运行时、内存使用或输出质量上相对于基线程序的回归问题,在5个系统应用和30个AI进化程序中发现49个隐藏弱点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.01708 2026-06-25 cs.DC cs.AI cs.LG 版本更新 62%

SplitZip: Ultra Fast Lossless KV Compression for Disaggregated LLM Serving

SplitZip:超快无损KV压缩用于解耦的大语言模型服务

Yipin Guo, Siddharth Joshi

机构 * University of Notre Dame IN, USA(诺丁汉大学)

专题命中 软件智能体 :agentic(abstract);分类 cs.AI、cs.LG

AI总结 SplitZip通过GPU友好的无损压缩技术,提升大规模LLM服务中KV缓存的传输效率,实现快速压缩和解压,显著优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11988 2026-06-25 cs.SE cs.AI 版本更新 62%

Evaluating AGENTS.md: Are Repository-Level Context Files Helpful for Coding Agents?

评估 AGENTS.md:仓库级上下文文件对编码助手有帮助吗?

Thibaud Gloaguen, Niels Mündler, Mark Müller, Veselin Raychev, Martin Vechev

机构 * Department of Computer Science(计算机科学系) ETH Zurich(苏黎世联邦理工学院)

专题命中 软件智能体 :agent(abstract);分类 cs.AI、cs.SE

AI总结 通过SWE-bench任务和开发者提交的上下文文件,评估发现上下文文件并未普遍提升编码助手的任务成功率,反而平均增加20%以上的推理成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26094 2026-06-25 cs.LG 新提交 57%

RevengeBench: Reverse Engineering Code-Space Policies from Behavioral Experiments

RevengeBench: 从行为实验中逆向工程代码空间策略

Babak Rahmani, Sebastian Dziadzio, Joschka Strüber, Sergio Hernández-Gutiérrez, Matthias Bethge

机构 * Tübingen AI Center(图宾根人工智能中心)

专题命中 软件智能体 :agent(abstract);分类 cs.LG

AI总结 提出RevengeBench基准,通过行为轨迹和可控实验逆向工程LLM生成的策略代码,验证恢复质量在34-72%之间,并能提升下游对战胜率。

Comments 12 pages, 5 figures, 22 appendix pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25879 2026-06-25 cs.DC cs.AI 新提交 57%

AI-Assisted Computational Reproducibility on the FABRIC Testbed

AI辅助计算可复现性在FABRIC试验台上的研究

Komal Thareja, Paul Ruth, Berent Aldikacti, Michael Zink

机构 * RENCI, University of North Carolina at Chapel Hill, NC, USA(RENCI,北卡罗来纳大学教堂山分校) University of Massachusetts Amherst, MA, USA(马萨诸塞大学阿姆赫斯特分校)

专题命中 软件智能体 :workflow(abstract);分类 cs.AI

AI总结 利用FABRIC试验台和LLM编码助手LoomAI,通过三个跨领域案例研究,展示了AI辅助工作流将复现实验的工作量减少约4-6倍,但在分析阶段仍需人工指导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25550 2026-06-25 cs.SE 新提交 57%

On the Viability of Requirements Generation From Code: An Experience Report

从代码生成需求的可行性:经验报告

Alexander Korn, Jone Bartel, Max Unterbusch, Andreas Vogelsang

专题命中 软件智能体 :agentic(abstract);分类 cs.SE

AI总结 本文通过实验评估基于LLM和RAG的代理方法从源代码生成需求,发现LLM无法可靠生成未实现需求、高质量需求或引入需求气味,且单一人工难以检测气味,表明该方法尚不可行。

Comments Accepted for publication at the 13th International Workshop on Artificial Intelligence and Requirements Engineering (AIRE'26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25195 2026-06-25 cs.CR cs.AI 新提交 57%

SoK: AI Secure Code Generation: Progress, Pitfalls, and Paths Forward

SoK:AI安全代码生成:进展、陷阱与前进之路

Rupam Patir, Keyan Guo, Haipeng Cai, Hongxin Hu

专题命中 软件智能体 :agentic(abstract);分类 cs.AI

AI总结 本文系统化分析AI安全代码生成的进展、陷阱与前进方向,提出三层次框架衡量模型对安全编码原则的理解、代码级执行及两者间的知识-执行差距,发现原则理解是代码安全性的强预测因子,但存在显著知识-执行差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25244 2026-06-25 cs.PL 新提交 50%

Reading AI Model Compilation in MLIR Through the Lens of Formal Theories

通过形式理论的视角解读MLIR中的AI模型编译

Javed Absar

专题命中 软件智能体 :agent(abstract)

AI总结 本文通过形式理论(如项重写系统、精化演算、抽象解释)对应MLIR的匹配-重写引擎、阶段降低和范围分析,论证形式概念有助于明确抽象完备性、理想设计及实际权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. GUI与网页智能体 6 篇

2606.23049 2026-06-25 cs.CL cs.AI 新提交 81%

PhoneBuddy: Training Open Models for Agentic Phone Use

训练用于代理电话使用的开放模型

Zhengyang Tang, Xin Lai, Pengyuan Lyu, Xinyuan Wang, Tianyi Bai, Chenxin Li, Yiduo Guo, Huawen Shen, Yuxuan Liu, Junyi Li, Zhengyao Fang, Yang Ding, Yi Zhang, Weinong Wang, Xingran Zhou, Liang Wu, Fei Tang, Sunqi Fan, Shangpin Peng, Zheng Ruan, Anran Zhang, Benyou Wang, Ji-Rong Wen, Rui Yan, Chengquan Zhang, Han Hu

机构 * Tencent Hunyuan(腾讯混元) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学高瓴人工智能学院) Wuhan University(武汉大学)

专题命中 GUI与网页智能体 :agentic(title,abstract);分类 cs.AI、cs.CL

AI总结 提出PhoneBuddy训练方案,结合真实应用环境和模拟应用环境PhoneWorld,通过混合强化学习提升开放模型在电话使用任务上的成功率,在150项人类评估中达到45.33%的成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25705 2026-06-25 cs.AI 新提交 79%

GUI agent: Guided Exploration of User-Sensitive Screens

GUI代理:用户敏感屏幕的引导探索

Aradhana Nayak, Mussadiq Nazeer, Wang Peng, Feng Liu

机构 * Huawei Heisenberg Research Center (Munich)(华为海森堡研究中心(慕尼黑)) Huawei Technologies Co., Ltd(华为技术有限公司)

专题命中 GUI与网页智能体 :agent(title,abstract);分类 cs.AI

AI总结 提出一种探索代理,通过系统性地探索查询空间,识别在GUI环境中执行后会导致用户敏感状态的查询,以提升LLM代理的安全性和可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04109 2026-06-25 cs.HC cs.AI 版本更新 70%

Tinker Tales: A Tangible Dialogue System for Child-AI Co-Creative Storytelling

Tinker Tales:一个用于儿童与AI共同创意故事讲述的有形对话系统

Nayoung Choi, Jiseung Hong, Peace Cyebukayire, Ikseon Choi, Jinho D. Choi

机构 * Department of Computer Science, Emory University(埃默里大学计算机科学系) Department of Computer Science, Carnegie Mellon University(卡内基梅隆大学计算机科学系) School of Nursing, Emory University(埃默里大学护理学院)

专题命中 GUI与网页智能体 :agent(abstract);AI agent(abstract);分类 cs.AI

AI总结 提出Tinker Tales有形对话系统,通过结合物理故事板、NFC玩具和移动应用,支持儿童与AI在四个叙事阶段进行协作故事创作,并发现提示框架影响儿童叙事贡献的形式和一致性。

Comments Accepted to SIGDIAL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25760 2026-06-25 cs.LG cs.AI cs.CL cs.CV 新提交 67%

Uncertainty Quantification for Computer-Use Agents: A Benchmark across Vision-Language Models and GUI Grounding Datasets

计算机使用代理的不确定性量化:跨视觉语言模型和GUI基础数据集的基准测试

Divake Kumar, Sina Tayebati, Devashri Naik, Amanda Sofie Rios, Nilesh Ahuja, Omesh Tickoo, Ranganath Krishnan, Amit Ranjan Trivedi

机构 * University of Illinois Chicago(伊利诺伊大学芝加哥分校) Intel Labs(英特尔实验室) Capital One AI Labs(Capital One AI实验室)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 提出跨机制基准Argus,评估27种后验不确定性量化方法在4个VLM代理和4个数据集上的表现,发现UQ排名在固定模型内跨数据集稳定,但跨模型类别和接口时下降,隐藏状态和密度方法最稳定。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25127 2026-06-25 cs.LG cs.AI math.OC 新提交 62%

Reward-Conditioned Attention: How Reward Design Shapes What Autonomous Driving Agents See

奖励条件注意力:奖励设计如何塑造自动驾驶代理的感知

Mohamed Benabdelouahad, Ahmed Djalal Hacini, Nadir Farhi, Aissa Boulmerka

机构 * National School of Artificial Intelligence (ENSIA)(国家人工智能学院) Cosys-Grettia, Univ Gustave Eiffel(古斯塔夫·埃菲尔大学Cosys-Grettia实验室)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI、cs.LG

AI总结 研究奖励设计如何影响自动驾驶强化学习代理的内部注意力模式,发现奖励内容直接决定编码器优先关注的场景元素,且连续碰撞时间惩罚会形成学习性警觉先验。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25119 2026-06-25 cs.RO 新提交 50%

SurveilNav: Collaborative Object Goal Navigation with Robot and Surveillance System

SurveilNav: 机器人与监控系统协同的目标导航

Ming-Ming Yu, Qunbo Wang, Rongtao Xu, Yanghong Mei, Yirong Yang, Longteng Guo, Wenjun Wu, Jing Liu

机构 * Beihang University(北京航空航天大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Beijing Jiaotong University(北京交通大学) ATeam University of Chinese Academy of Sciences(中国科学院大学) Hangzhou International Innovation Institute, Beihang University(北京航空航天大学杭州国际创新研究院)

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 提出SurveilNav框架,通过主动摄像头调度、联合2D/3D建图、基于VLM的价值估计和协同目标验证,融合机器人动态局部感知与监控全局视图,在HM3D数据集上实现领先的探索效率和导航成功率。

Comments Accepted by ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 记忆与上下文管理 11 篇

2606.25115 2026-06-25 cs.LG cs.NI 新提交 83%

Forget to Improve: On-Device LLM-Agent Continual Learning via Budget-Curated Memory

遗忘以改进:通过预算策划内存的设备端LLM智能体持续学习

Beining Wu, Zihao Ding, Jun Huang, Yanxiao Zhao

机构 * Apple(苹果) Google(谷歌) Microsoft(微软) Meta Alibaba(阿里巴巴)

专题命中 记忆与上下文管理 :agent(title,abstract);agentic(abstract);分类 cs.LG

AI总结 提出净价值每字节评分机制,在设备端智能体内存中权衡价值与危害,实现预算约束下的记忆保留、共享与信任决策,降低内存和上行带宽并防御注入攻击。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23195 2026-06-25 cs.LG cs.AI cs.CL 新提交 82%

Memory Contagion: Cross-Temporal Propagation of Evaluator Bias via Agent Memory

记忆传染:通过智能体记忆的评估者偏见的跨时间传播

Zewen Liu

机构 * Independent Researcher(独立研究员)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 研究大型语言模型智能体记忆中评估者偏见通过记忆存储跨时间传播的现象,发现即使完美记忆整合也会导致偏见传播,且无安全阈值。

Comments 12 pages, 3 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07803 2026-06-25 eess.SY cs.SY 新提交 82%

Stable but Unsafe: Agent-Driven Cyber-Physical Systems Under Gain Manipulation Attacks

无安全性的稳定性:对自主网络物理系统的增益操纵攻击

Ali Eslami, Jiangbo Yu

专题命中 记忆与上下文管理 :agent(title,abstract);AI agent(abstract)

AI总结 本文形式化自主网络物理系统中的增益操纵攻击,通过三轴攻击模型和分类法,揭示稳定性保持的增益替换仍可产生远超安全限度的瞬态放大,并利用Bauer-Fike特征值界和Kreiss矩阵定理推导隐蔽条件和最坏影响。

Comments 6 pages, 2 figures, 2 tables. Submitted to IEEE L-CSS for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19532 2026-06-25 cs.LG 版本更新 70%

Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning

狐狸进鸡窝:针对强化学习的供应链后门攻击

Shijie Liu, Andrew C. Cullen, Paul Montague, Sarah Erfani, Benjamin I. P. Rubinstein

机构 * School of Computing and Information Systems, University of Melbourne, Parkville, Australia(墨尔本大学计算机与信息系统学院,墨尔本,澳大利亚)

专题命中 记忆与上下文管理 :agent(abstract);workflow(abstract);分类 cs.LG

AI总结 提出SCAB攻击,通过污染仅3%的训练经验即可激活超过90%的触发动作,使受害者平均每轮回报降低80%,揭示了强化学习供应链中的后门攻击风险。

Comments Forty-Third International Conference on Machine Learning (ICML2026)

详情

展开后加载摘要…

URL PDF HTML 收藏