Formal Methods Meet LLMs: Auditing, Monitoring, and Intervention for Compliance of Advanced AI Systems
形式方法与大语言模型交汇:面向高级AI系统合规性的审计、监控与干预
机构 * University of Toronto, Vector Institute(多伦多大学,向量研究所)
AI总结 本文提出结合形式方法与机器学习的审计和监控技术,用于检测AI系统中时间扩展行为约束的违规,实验表明其在检测违规方面优于LLM基方法,且能有效降低LLM代理的违规率。