P3T: Prototypical Point-level Prompt Tuning with Enhanced Generalization for 3D Vision-Language Models
P3T: 用于3D视觉-语言模型的增强泛化原型点级提示微调
机构 * Department of Artificial Intelligence, University of Seoul(首尔大学人工智能系) ; Department of Applied Statistics, Yonsei University(延世大学应用统计系)
专题命中 点云 :3D vision(title,abstract);point cloud(abstract);分类 cs.CV
AI总结 本文提出P3T,一种针对3D视觉-语言模型的高效提示微调方法,通过点级提示器和文本提示器提升模型泛化能力,并引入原型损失减少类别内方差,实验表明其在分类和少样本学习中表现优异。
Comments Accepted by ICRA 2026