FOMO-3D: Using Vision Foundation Models for Long-Tailed 3D Object Detection
FOMO-3D:利用视觉基础模型进行长尾3D目标检测
机构 * Waabi ; University of Toronto(多伦多大学)
专题命中 自动驾驶多传感器融合 :multi-modal fusion(abstract);分类 cs.CV、cs.RO
AI总结 FOMO-3D通过利用视觉基础模型的丰富先验知识和多模态融合设计,提升长尾3D目标检测的性能。
Comments Published at 9th Annual Conference on Robot Learning (CoRL 2025)