Towards Backdoor-Based Ownership Verification for Vision-Language-Action Models
面向视觉-语言-动作模型的后门基于所有权验证
机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) ; School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络安全学院) ; A*STAR Institute of High Performance Computing (A*STAR IHPC)(新加坡A*STAR高性能计算研究所) ; A*STAR Centre for Frontier AI Research (A*STAR CFAR)(新加坡A*STAR前沿人工智能研究中心) ; College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算机与数据科学学院) ; College of Design and Engineering, Nanyang Technological University(南洋理工大学设计与工程学院) ; Department of Computer Science, National University of Singapore(新加坡国立大学计算机科学系) ; State Key Laboratory of Information Engineering in Surveying, Mapping and Remote Sensing (LIESMARS), Wuhan University(武汉大学测绘遥感信息工程国家重点实验室(LIESMARS))
专题命中 多模态Agent :multi-modal(abstract);分类 cs.AI
AI总结 本文提出GuardVLA,首个针对视觉-语言-动作模型的后门基于所有权验证框架,通过在训练中嵌入隐蔽无害的后门水印,实现可靠的模型所有权验证并保持正常任务性能。