Sentra-Guard: A Real-Time Multilingual Defense Against Adversarial LLM Prompts
Sentra-Guard:一种实时多语言对抗对抗性LLM提示的防御系统
专题命中 提示注入 :jailbreak(abstract);prompt injection(abstract);分类 cs.AI
AI总结 Sentra-Guard通过混合架构和分类器-检索器融合模块,实时检测并缓解针对大语言模型的劫持和提示注入攻击,实现多语言鲁棒性与高检测率。
Comments 11 pages, 5 figures. Preprint version under review in the area of Artificial Intelligence (cs.AI)