DriveStack-VLA: Render-Teacher Alignment for BEV-Based DeepStack Vision-Language-Action Model
DriveStack-VLA: 基于BEV的DeepStack视觉-语言-动作模型的渲染-教师对齐
机构 * Zhejiang University(浙江大学) ; The 2012 Labs, Huawei(华为2012实验室)
专题命中 安全训练 :alignment(title,abstract);safety(abstract)
AI总结 提出DriveStack-VLA框架,通过DeepStack连接注入BEV表示并采用渲染-教师对齐增强空间感知,引入自批评模块优化轨迹选择,在多个驾驶基准上取得领先性能。