BadSkill: Backdoor Attacks on Agent Skills via Model-in-Skill Poisoning
BadSkill: 通过模型-技能污染对代理技能进行后门攻击
机构 * Huazhong University of Science and Technology(华中科技大学) ; Lehigh University(里海大学)
AI总结 研究针对代理技能中嵌入的模型提出后门攻击,通过污染技能中的模型实现隐蔽攻击,验证了在不同模型规模和扰动类型下的有效性,并指出模型承载技能作为代理生态系统中的新型供应链风险。
Comments 4 pages, 4 fIGURES