TrinityGuard: A Unified Framework for Safeguarding Multi-Agent Systems
TrinityGuard:多智能体系统的统一防护框架
机构 * Shanghai AI Laboratory(上海人工智能实验室)
专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.CL、cs.LG
AI总结 本文提出TrinityGuard框架,用于评估和监控基于大语言模型的多智能体系统安全风险,通过三级风险分类识别20种风险类型,结合测试模块和运行时监控实现预开发评估与运行时监控。