RLM: A Vision-Language Model Approach for Radar Scene Understanding
RLM:一种用于雷达场景理解的视觉-语言模型方法
机构 * University of California San Diego(加州大学圣地亚哥分校) ; Blue River Technology
AI总结 本文提出RadarVLM,通过结构化空间语言监督学习统一的场景表示,改进了雷达场景理解中的空间推理能力,实验显示其在生成描述和车辆分割任务中性能显著提升。