VT-DUDA: Visual Token Conditioning for Diffusion-guided Unsupervised Domain Adaptation
VT-DUDA: 扩散引导的无监督域适应的视觉令牌条件化
机构 * Istituto Italiano di Tecnologia(意大利技术研究院) ; University of Genoa(热那亚大学) ; University of Verona(维罗纳大学)
专题命中 机器人操作 :manipulation(abstract);分类 cs.CV
AI总结 提出VT-DUDA框架,通过将源图像映射为视觉令牌并与文本嵌入拼接作为条件,增强扩散模型生成目标风格图像时的实例级引导,提升无监督域适应性能。
Journal ref Transactions on Machine Learning Research, 2026