SafeFlow: Semantic Information-Flow Control for Blocking Malicious Propagation in Multi-Agent Systems
SafeFlow:用于多智能体系统中阻止恶意传播的语义信息流控制
专题命中 越狱攻击 :safety(abstract);jailbreak(abstract);prompt injection(abstract)
AI总结 研究多智能体系统恶意传播问题,提出SafeFlow框架,将恶意跨智能体传播形式化为语义信息流问题,通过附加污点、传播及工作流级验证重建风险上下文,经测试降低攻击成功率,保持良性任务完成率,揭示系统缺乏跨委托边界保留风险语义机制。