arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-04-16 至 2026-04-16 共收录 2 信号源:cs.CV, cs.GR, cs.MM

1. 个性化与一致性 2 篇

2604.13841 2026-04-16 cs.CV 70%

DiffMagicFace: Identity Consistent Facial Editing of Real Videos

DiffMagicFace: 实现实时视频中人脸的恒定身份编辑

Huanghao Yin, Shenkun Xu, Kanle Shi, Junhai Yong, Bin Wang

机构 * Tsinghua University(清华大学)

专题命中 个性化与一致性 :diffusion(abstract);image editing(abstract);分类 cs.CV

AI总结 本文提出DiffMagicFace框架,通过整合文本和图像控制模型,实现视频中人脸编辑时保持身份一致性和内容一致性,无需依赖视频数据集,效果在视觉和量化指标上均优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07823 2026-04-16 cs.CV cs.AI cs.MM 62%

LPM 1.0: Video-based Character Performance Model

LPM 1.0:基于视频的角色表现模型

Ailing Zeng, Casper Yang, Chauncey Ge, Eddie Zhang, Garvey Xu, Gavin Lin, Gilbert Gu, Jeremy Pi, Leo Li, Mingyi Shi, Shawn Wang, Sheng Bi, Steven Tang, Thorn Hang, Tobey Guo, Vincent Li, Xin Tong, Yikang Li, Yuchen Sun, Yue Zhao, Yuhan Lu, Yuwei Li, Zane Zhang, Zeshi Yang, Zi Ye

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV、cs.MM

AI总结 本文提出LPM 1.0模型,通过构建多模态数据集和训练扩散变换器,实现高可控性和身份一致性的角色表现生成,支持实时交互和无限长度生成。

Comments 43 pages, 15 figures, 2 tables. Project page: https://large-performance-model.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏