VLMaterial: Vision-Language Model-Based Camera-Radar Fusion for Physics-Grounded Material Identification
VLMaterial: 基于视觉-语言模型的相机-雷达融合用于物理基础的材料识别
机构 * Department of Inforation Engineering(信息工程系)
专题命中 幻觉与鲁棒性 :vision-language model(title,abstract);VLM(abstract,abstract_cn)
AI总结 本文提出VLMaterial框架,通过融合视觉语言模型与雷达知识实现物理基础的材料识别,采用双管道架构和上下文增强生成策略,提升跨模态融合性能,实验表明其在120余次真实实验中达到96.08%的识别准确率。