BarrierBench: Evaluating Large Language Models for Safety Verification in Dynamical Systems
BarrierBench: 评估大型语言模型在动态系统安全验证中的性能
机构 * Isfahan University of Technology(伊斯法罕技术大学) ; Max Planck Institute for Software Systems(马克斯·普朗克软件系统研究所) ; University of Colorado Boulder(科罗拉多大学博尔德分校)
专题命中 安全评测 :safety(title,abstract);分类 cs.AI
AI总结 本文提出BarrierBench基准,评估大型语言模型在动态系统安全验证中的能力,通过100个动态系统案例测试语言模型在生成安全证书和协调策略中的有效性。
Comments 8th Annual Learning for Dynamics & Control Conference