SafeGen: Goal-Conditioned Video Diffusion of Safety-Critical Scenarios for VLM-Based Autonomous Driving
SafeGen:基于视觉语言模型的自动驾驶安全关键场景的目标条件视频扩散
机构 * Beihang University(北京航空航天大学) ; Zhongguancun Laboratory(中关村实验室) ; Chery Automobile Co., Ltd.(奇瑞汽车股份有限公司)
专题命中 仿真评测 :autonomous driving(title);分类 cs.CV
AI总结 研究针对VLM在自动驾驶系统中的应用,提出SafeGen框架,将场景生成设为目标条件扩散过程,引入上下文接地最终状态推理和最终状态条件下的视频演化,实验表明该框架能提升评判得分,微调后可提高真实驾驶场景性能。