Temporal Context Awareness: A Defense Framework Against Multi-turn Manipulation Attacks on Large Language Models
时序上下文感知:一种针对大型语言模型多轮操纵攻击的防御框架
专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);分类 cs.AI、cs.LG
AI总结 针对LLMs易受多轮操纵攻击的问题,本文提出TCA框架,通过分析语义漂移等实现防御,初步评估显示其能识别传统方法遗漏的微妙操纵模式,为对话式AI系统提供安全保障。
Comments 6 pages, 2 figures, IEEE CAI