Dynamic Cluster Data Sampling for Efficient and Long-Tail-Aware Vision-Language Pre-training
动态聚类数据采样用于高效且长尾感知的视觉-语言预训练
机构 * Institute for Computing and Information Sciences(计算与信息科学研究所)
专题命中 VLM训练与架构 :VLM(abstract,abstract_cn);vision-language model(abstract);分类 cs.CV
AI总结 本文提出动态聚类采样方法DynamiCS,通过动态调整数据分布平衡语义长尾概念,降低训练成本并提升长尾概念表现。
Comments Accepted by ECCV 2026