Multimodal Distribution Matching for Vision-Language Dataset Distillation
多模态分布匹配用于视觉-语言数据集蒸馏
机构 * Visual Intelligence Lab., KAIST(韩国科学技术院视觉智能实验室)
AI总结 提出多模态分布匹配(MDM)框架,通过数据、模型和损失层面的几何感知组件,高效压缩视觉-语言数据集并保持跨模态对齐。
Comments Accepted for publication at CVPR 2026. Project Page: https://andyj1.github.io/mdm