Image-based Prompt Injection: Hijacking Multimodal LLMs through Visually Embedded Adversarial Instructions
基于图像的提示注入:通过视觉嵌入的对抗性指令劫持多模态大语言模型
机构 * Northern Arizona University(北亚利桑那大学)
专题命中 跨模态检索 :multimodal(title,abstract);分类 cs.CV、cs.AI
AI总结 研究提出基于图像的提示注入攻击方法,通过视觉嵌入对抗性指令,成功操控多模态大语言模型输出,揭示了该攻击的有效性和潜在威胁。
Comments 7 pages, published in 2025 3rd International Conference on Foundation and Large Language Models (FLLM), Vienna, Austria
Journal ref 2025 3rd International Conference on Foundation and Large Language Models (FLLM), Vienna, Austria, 2025, pp. 916-922