DriveVA: Video Action Models are Zero-Shot Drivers
DriveVA: 视频动作模型是零样本驱动器
机构 * University of Twente(特温特大学) ; Xiaomi EV(小米电动汽车) ; University of Cambridge(剑桥大学) ; University of Bath(巴斯大学)
AI总结 DriveVA提出了一种新的自动驾驶世界模型,通过共享潜在生成过程联合解码未来视觉预测和动作序列,提升跨数据集和传感器配置的泛化能力,减少碰撞率和误差。
Comments Accepted to ECCV 2026. 30 pages, 12 figures, 11 tables