arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 1266 信号源:cs.CV, cs.GR, cs.MM

1. 个性化与一致性 1266 篇

2512.02781 2025-12-03 cs.CV cs.GR cs.LG 62%

LumiX: Structured and Coherent Text-to-Intrinsic Generation

LumiX: 结构化和一致的文本到内在生成

Xu Han, Biao Zhang, Xiangjun Tang, Xianzhi Li, Peter Wonka

机构 * HUST(华中科技大学) KAUST(科威特大学)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV、cs.GR

AI总结 LumiX通过结构化扩散框架实现文本到内在生成,结合查询广播注意力和张量LoRA,提升生成的物理一致性和效率。

Comments The code will be available at https://github.com/xhanxu/LumiX

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00413 2025-12-02 cs.CV cs.GR 62%

SplatFont3D: Structure-Aware Text-to-3D Artistic Font Generation with Part-Level Style Control

SplatFont3D: 基于结构的文本到3D艺术字体生成与部分级风格控制

Ji Gan, Lingxu Chen, Jiaxu Leng, Xinbo Gao

机构 * Chongqing University of Posts and Telecommunications(重庆邮电大学) Xidian University(西安电子科技大学)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV、cs.GR

AI总结 SplatFont3D通过3D高斯溅射技术实现基于结构的文本到3D艺术字体生成,提供精确的部分级风格控制,提升渲染效率和视觉质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23605 2025-10-28 cs.CV cs.AI cs.GR cs.LG cs.RO 62%

Track, Inpaint, Resplat: Subject-driven 3D and 4D Generation with Progressive Texture Infilling

Shuhong Zheng, Ashkan Mirzaei, Igor Gilitschenski

机构 * University of Toronto(多伦多大学) Vector Institute(向量研究所) Snap Inc.(Snap公司)

专题命中 个性化与一致性 :inpainting(abstract);分类 cs.CV、cs.GR

Comments NeurIPS 2025, 38 pages, 22 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15058 2025-10-15 cs.SD cs.AI cs.CV cs.GR eess.AS 62%

AsynFusion: Towards Asynchronous Latent Consistency Models for Decoupled Whole-Body Audio-Driven Avatars

Tianbao Zhang, Jian Zhao, Yuer Li, Zheng Zhu, Ping Hu, Zhaoxin Fan, Wenjun Wu, Xuelong Li

机构 * Institute of Artificial Intelligence (TeleAI), China Telecom(人工智能研究院(TeleAI)、中国电信) Beijing Advanced Innovation Center for Future Blockchain and Privacy Computing(未来区块链与隐私计算先进创新中心) School of Artificial Intelligence, Beihang University(北航人工智能学院) Hangzhou International Innovation Institute, Beihang University(杭州国际创新研究院,北航) School of Computer Science and Technology, Xinjiang University(新疆大学计算机科学与技术学院) GigaAI

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV、cs.GR

Comments 15pages, conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26233 2025-10-01 cs.GR cs.AI cs.CV 62%

3DiFACE: Synthesizing and Editing Holistic 3D Facial Animation

Balamurugan Thambiraja, Malte Prinzler, Sadegh Aliakbarian, Darren Cosker, Justus Thies

机构 * Max Planck Institute for Intelligent Systems(马克斯·普朗克智能系统研究所) Max Planck ETH Center for Intelligent Systems(马克斯·普朗克-苏黎世联邦理工学院智能系统中心) Technical University of Darmstadt(德累斯顿技术大学) ETH Zürich(苏黎世联邦理工学院) Microsoft Mixed Reality & AI Lab, UK(英国微软混合现实与人工智能实验室)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV、cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25058 2025-09-30 cs.GR cs.CV 62%

CharGen: Fast and Fluent Portrait Modification

Jan-Niklas Dihlmann, Arnela Killguss, Hendrik P. A. Lensch

机构 * University of Tübingen Germany(图宾根大学)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV、cs.GR

Comments Project page: https://chargen.jdihlmann.com/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.18948 2025-09-24 cs.GR cs.CV 62%

One-shot Embroidery Customization via Contrastive LoRA Modulation

Jun Ma, Qian He, Gaofeng He, Huang Chen, Chen Liu, Xiaogang Jin, Huamin Wang

机构 * Zhejiang Sci-Tech University(浙江科技学院) Style3D Research(Style3D研究) State Key Lab of CAD\&CG, Zhejiang University(CAD\&CG国家重点实验室) Style3D Research Hangzhou China(Style3D研究杭州中国)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV、cs.GR

Comments Accepted to ACM Transactions on Graphics (TOG), SIGGRAPH Asia 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01362 2025-09-03 cs.CV cs.MM 62%

Identity-Preserving Text-to-Video Generation via Training-Free Prompt, Image, and Guidance Enhancement

Jiayi Gao, Changcheng Hua, Qingchao Chen, Yuxin Peng, Yang Liu

机构 * Wangxuan Institute of Computer Technology, Peking University(北京大学计算机技术研究院)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV、cs.MM

Comments 7 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09983 2025-08-14 cs.CV cs.GR cs.LG 62%

Story2Board: A Training-Free Approach for Expressive Storyboard Generation

David Dinkevich, Matan Levy, Omri Avrahami, Dvir Samuel, Dani Lischinski

机构 * Hebrew University of Jerusalem(耶路撒冷希伯来大学) OriginAI Bar-Ilan University(巴伊兰大学)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV、cs.GR

Comments Project page is available at https://daviddinkevich.github.io/Story2Board/

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.08676 2025-07-22 cs.CV cs.GR 62%

FlexiClip: Locality-Preserving Free-Form Character Animation

Anant Khandelwal

机构 * Search Technology Center India, Microsoft, IDC, Bengaluru, India(Bharat)(印度搜索技术中心、微软、IDC、班加罗尔、印度(巴哈拉特))

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV、cs.GR

Comments 13 pages, 4 figures, 7 tables, Accepted in ICML 2025, https://openreview.net/forum?id=xtxCM4XZ82

Journal ref Proceedings of the 42nd International Conference on Machine Learning, Vancouver, Canada. PMLR 267, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.05412 2025-06-19 cs.CV cs.AI cs.MM 62%

Style-Preserving Lip Sync via Audio-Aware Style Reference

Weizhi Zhong, Jichang Li, Yinqi Cai, Ming Li, Feng Gao, Liang Lin, Guanbin Li

机构 * School of Computer Science and Engineering, Sun Yat-sen University(中山大学计算机科学与工程学院) Shandong Inspur Database Technology Co., Ltd.(山东 Inspur 数据库技术有限公司) Peking University(北京大学) Peng Cheng Laboratory(鹏城实验室)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV、cs.MM

Comments submitted to IEEE Transactions on Multimedia(TMM)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02620 2025-06-04 cs.GR cs.CV 62%

FlexPainter: Flexible and Multi-View Consistent Texture Generation

Dongyu Yan, Leyi Wu, Jiantao Lin, Luozhou Wang, Tianshuo Xu, Zhifei Chen, Zhen Yang, Lie Xu, Shunsi Zhang, Yingcong Chen

机构 * HKUST(GZ)(香港科技大学(广州)) Quwan(启文) HKUST(香港科技大学)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV、cs.GR

Comments 11 pages, 10 figures in main paper, 10 pages, 12 figures in supplementary

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.19451 2025-05-21 cs.CV cs.GR 62%

Perm: A Parametric Representation for Multi-Style 3D Hair Modeling

Chengan He, Xin Sun, Zhixin Shu, Fujun Luan, Sören Pirk, Jorge Alejandro Amador Herrera, Dominik L. Michels, Tuanfeng Y. Wang, Meng Zhang, Holly Rushmeier, Yi Zhou

机构 * Yale University(耶鲁大学) Adobe Research(Adobe研究) Kiel University(基尔大学) KAUST(王国学术科技研究理事会) NJUST(南京理工大学)

专题命中 个性化与一致性 :image generation(abstract);分类 cs.CV、cs.GR

Comments Accepted to ICLR 2025. Project page: https://cs.yale.edu/homes/che/projects/perm/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23241 2025-04-04 cs.GR cs.CV 62%

Geometry in Style: 3D Stylization via Surface Normal Deformation

Nam Anh Dinh, Itai Lang, Hyunwoo Kim, Oded Stein, Rana Hanocka

专题命中 个性化与一致性 :text-to-image(abstract);分类 cs.CV、cs.GR

Comments CVPR 2025. Our project page is at https://threedle.github.io/geometry-in-style

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.21775 2025-03-31 cs.CV cs.AI cs.CL cs.GR cs.LG 62%

StyleMotif: Multi-Modal Motion Stylization using Style-Content Cross Fusion

Ziyu Guo, Young Yoon Lee, Joseph Liu, Yizhak Ben-Shabat, Victor Zordan, Mubbasir Kapadia

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV、cs.GR

Comments Project Page: https://stylemotif.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.17440 2025-03-27 cs.CV cs.MM 62%

Identity-Preserving Text-to-Video Generation by Frequency Decomposition

Shenghai Yuan, Jinfa Huang, Xianyi He, Yunyuan Ge, Yujun Shi, Liuhan Chen, Jiebo Luo, Li Yuan

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV、cs.MM

Comments CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.11394 2025-02-12 cs.CV cs.AI cs.GR cs.LG 62%

DreamCatalyst: Fast and High-Quality 3D Editing via Controlling Editability and Identity Preservation

Jiwook Kim, Seonho Lee, Jaeyo Shin, Jiho Choi, Hyunjung Shim

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV、cs.GR

Comments ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.13969 2025-01-27 cs.CV cs.GR cs.LG 62%

InsTex: Indoor Scenes Stylized Texture Synthesis

Yunfan Zhang, Zhiwei Xiong, Zhiqi Shen, Guosheng Lin, Hao Wang, Nicolas Vun

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV、cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.14214 2024-12-20 cs.GR cs.AI cs.CV 62%

GraphicsDreamer: Image to 3D Generation with Physical Consistency

Pei Chen, Fudong Wang, Yixuan Tong, Jingdong Chen, Ming Yang, Minghui Yang

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV、cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.14468 2024-11-05 cs.CV cs.AI cs.MM 62%

AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks

Max Ku, Cong Wei, Weiming Ren, Harry Yang, Wenhu Chen

专题命中 个性化与一致性 :image editing(abstract);分类 cs.CV、cs.MM

Comments Published in Transactions on Machine Learning Research (TMLR 2024) (11/2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.00399 2024-11-04 cs.CV cs.GR 62%

StyleTex: Style Image-Guided Texture Generation for 3D Models

Zhiyu Xie, Yuqing Zhang, Xiangjun Tang, Yiqian Wu, Dehan Chen, Gongsheng Li, Xaogang Jin

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV、cs.GR

Comments Accepted to Siggraph Asia 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.20389 2024-10-29 cs.CV cs.AI cs.GR 62%

Lodge++: High-quality and Long Dance Generation with Vivid Choreography Patterns

Ronghui Li, Hongwen Zhang, Yachao Zhang, Yuxiang Zhang, Youliang Zhang, Jie Guo, Yan Zhang, Xiu Li, Yebin Liu

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV、cs.GR

Comments Project page: https://li-ronghui.github.io/lodgepp

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.16395 2024-10-23 cs.CV cs.GR 62%

Joker: Conditional 3D Head Synthesis with Extreme Facial Expressions

Malte Prinzler, Egor Zakharov, Vanessa Sklyarova, Berna Kabadayi, Justus Thies

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV、cs.GR

Comments Project Page: https://malteprinzler.github.io/projects/joker/

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.13711 2024-10-15 cs.CV cs.MM 62%

SceneDreamer360: Text-Driven 3D-Consistent Scene Generation with Panoramic Gaussian Splatting

Wenrui Li, Fucheng Cai, Yapeng Mi, Zhe Yang, Wangmeng Zuo, Xingtao Wang, Xiaopeng Fan

专题命中 个性化与一致性 :image generation(abstract);分类 cs.CV、cs.MM

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.02216 2024-07-23 cs.GR cs.CV 62%

DragVideo: Interactive Drag-style Video Editing

Yufan Deng, Ruida Wang, Yuhao Zhang, Yu-Wing Tai, Chi-Keung Tang

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV、cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.18539 2024-06-28 cs.CV cs.GR 62%

TexPainter: Generative Mesh Texturing with Multi-view Consistency

Hongkun Zhang, Zherong Pan, Congyi Zhang, Lifeng Zhu, Xifeng Gao

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV、cs.GR

Comments accepted by Siggraph 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.13944 2024-04-23 cs.CV cs.MM 62%

Gorgeous: Create Your Desired Character Facial Makeup from Any Ideas

Jia Wei Sii, Chee Seng Chan

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV、cs.MM

Comments Project page: https://github.com/JiaWeiSii/gorgeous/

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.10805 2024-03-19 cs.SD cs.AI cs.CV cs.GR cs.HC eess.AS 62%

Speech-driven Personalized Gesture Synthetics: Harnessing Automatic Fuzzy Feature Inference

Fan Zhang, Zhaohan Wang, Xin Lyu, Siyuan Zhao, Mengjian Li, Weidong Geng, Naye Ji, Hui Du, Fuxing Gao, Hao Wu, Shunman Li

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV、cs.GR

Comments 12 pages,

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.07952 2024-03-14 cs.CV cs.AI cs.MM 62%

AesopAgent: Agent-driven Evolutionary System on Story-to-Video Production

Jiuniu Wang, Zehua Du, Yuyuan Zhao, Bo Yuan, Kexiang Wang, Jian Liang, Yaxi Zhao, Yihen Lu, Gengliang Li, Junlong Gao, Xin Tu, Zhenyu Guo

专题命中 个性化与一致性 :image generation(abstract);分类 cs.CV、cs.MM

Comments 22 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.12903 2023-05-23 cs.CV cs.LG cs.MM 62%

DiffAVA: Personalized Text-to-Audio Generation with Visual Alignment

Shentong Mo, Jing Shi, Yapeng Tian

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV、cs.MM

详情

展开后加载摘要…

URL PDF HTML 收藏