arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-05-01 至 2026-05-01 共收录 1 信号源:cs.CV, cs.GR, cs.MM

1. 图像生成评测 1 篇

2604.27958 2026-05-01 cs.CV 57%

TripVVT: A Large-Scale Triplet Dataset and a Coarse-Mask Baseline for In-the-Wild Video Virtual Try-On

TripVVT:一个大规模三元组数据集和一个粗略遮罩基线用于真实场景视频虚拟试穿

Dingbao Shao, Song Wu, Shenyi Wang, Ye Wang, Ziheng Tang, Fei Liu, Jiang Lin, Xinyu Chen, Qian Wang, Ying Tai, Jian Yang, Zili Yi

机构 * Nanjing University, China(南京大学) JIUTIAN Research, CMCC, China(JIUTIAN研究院,CMCC,中国) Jilin University, China(吉林大学) ByteDance Inc., China(字节跳动公司)

专题命中 图像生成评测 :diffusion(abstract);分类 cs.CV

AI总结 本文提出TripVVT-10K数据集和TripVVT框架,通过改进的遮罩先验提升视频虚拟试穿的鲁棒性和质量,同时建立评估基准以验证其在复杂场景中的泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏