arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 1267 信号源:cs.CV, cs.GR, cs.MM

1. 个性化与一致性 1267 篇

2505.06117 2025-05-12 cs.CV 57%

Photovoltaic Defect Image Generator with Boundary Alignment Smoothing Constraint for Domain Shift Mitigation

Dongying Li, Binyi Su, Hua Zhang, Yong Li, Haiyong Chen

机构 * School of Artificial Intelligence and Data Science, Hebei University of Technology(人工智能与数据科学学院,河北工业大学) China Xiongan Group Digital City Technology Company Ltd.(雄安集团数字城市技术有限公司) State Key Laboratory of Information Security, Institute of Information Engineering, Chinese Academy of Sciences(信息安全国家重点实验室,信息工程研究所,中国科学院) school of Instrumentation and Optoelectronic Engineering, Beihang University(仪器与光电工程学院,北航)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.11815 2025-05-06 cs.CV 57%

ColorFlow: Retrieval-Augmented Image Sequence Colorization

Junhao Zhuang, Xuan Ju, Zhaoyang Zhang, Yong Liu, Shiyi Zhang, Chun Yuan, Ying Shan

机构 * Tsinghua University(清华大学) ARC Lab, Tencent PCG(腾讯PCG广告实验室)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

Comments Project Page: https://zhuang2002.github.io/ColorFlow/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.01172 2025-05-05 cs.CV 57%

FreePCA: Integrating Consistency Information across Long-short Frames in Training-free Long Video Generation via Principal Component Analysis

Jiangtong Tan, Hu Yu, Jie Huang, Jie Xiao, Feng Zhao

机构 * MoE Key Laboratory of Brain-inspired Intelligent Perception and Cognition, University of Science and Technology of China(脑启发智能感知与认知联合实验室,中国科学技术大学)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.21836 2025-05-01 cs.CV 57%

3D Stylization via Large Reconstruction Model

Ipek Oztas, Duygu Ceylan, Aysegul Dundar

机构 * Bilkent University(比尔肯大学) Adobe Research(Adobe研究)

专题命中 个性化与一致性 :image generation(abstract);分类 cs.CV

Comments Accepted to SIGGRAPH 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.20998 2025-04-30 cs.CV cs.AI 57%

YoChameleon: Personalized Vision and Language Generation

Thao Nguyen, Krishna Kumar Singh, Jing Shi, Trung Bui, Yong Jae Lee, Yuheng Li

机构 * University of Wisconsin–Madison(威斯康星大学麦迪逊分校) Adobe Research(Adobe研究院)

专题命中 个性化与一致性 :image generation(abstract);分类 cs.CV

Comments CVPR 2025; Project page: https://thaoshibe.github.io/YoChameleon

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.17826 2025-04-28 cs.CV cs.AI 57%

FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model

Kaicheng Pang, Xingxing Zou, Waikeung Wong

机构 * Laboratory for Artificial Intelligence in Design(人工智能设计实验室) School of Fashion and Textiles(时尚与纺织学院)

专题命中 个性化与一致性 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.15179 2025-04-22 cs.CV 57%

FaceCraft4D: Animated 3D Facial Avatar Generation from a Single Image

Fei Yin, Mallikarjun B R, Chun-Han Yao, Rafał Mantiuk, Varun Jampani

机构 * University of Cambridge(剑桥大学) Stability AI

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06235 2025-04-18 cs.CV cs.LG 57%

VariFace: Fair and Diverse Synthetic Dataset Generation for Face Recognition

Michael Yeung, Toya Teramoto, Songtao Wu, Tatsuo Fujiwara, Kenji Suzuki, Tamaki Kojima

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11266 2025-04-16 cs.CV 57%

CyclePose -- Leveraging Cycle-Consistency for Annotation-Free Nuclei Segmentation in Fluorescence Microscopy

Jonas Utz, Stefan Vocht, Anne Tjorven Buessen, Dennis Possart, Fabian Wagner, Mareike Thies, Mingxuan Gu, Stefan Uderhardt, Katharina Breininger

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

Comments under review for MICCAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.14496 2025-04-15 cs.CV 57%

WikiStyle+: A Multimodal Approach to Content-Style Representation Disentanglement for Artistic Image Stylization

Ma Zhuoqi, Zhang Yixuan, You Zejun, Tian Long, Liu Xiyang

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.00664 2025-04-15 cs.LG cs.CV stat.ML 57%

Improving Decoupled Posterior Sampling for Inverse Problems using Data Consistency Constraint

Zhi Qi, Shihong Yuan, Yulin Yuan, Linling Kuang, Yoshiyuki Kabashima, Xiangming Meng

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.13984 2025-04-15 cs.CV 57%

RHanDS: Refining Malformed Hands for Generated Images with Decoupled Structure and Style Guidance

Chengrui Wang, Pengfei Liu, Min Zhou, Ming Zeng, Xubin Li, Tiezheng Ge, Bo zheng

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.04842 2025-04-08 cs.CV 57%

FantasyTalking: Realistic Talking Portrait Generation via Coherent Motion Synthesis

Mengchao Wang, Qiang Wang, Fan Jiang, Yaqi Fan, Yunpeng Zhang, Yonggang Qi, Kun Zhao, Mu Xu

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.04427 2025-04-08 cs.CV cs.AI cs.HC 57%

FluentLip: A Phonemes-Based Two-stage Approach for Audio-Driven Lip Synthesis with Optical Flow Consistency

Shiyan Liu, Rui Qu, Yan Jin

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.02541 2025-04-08 cs.CV 57%

Enhancing Temporal Consistency in Video Editing by Reconstructing Videos with 3D Gaussian Splatting

Inkyu Shin, Qihang Yu, Xiaohui Shen, In So Kweon, Kuk-Jin Yoon, Liang-Chieh Chen

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

Comments Accepted to TMLR 2025. Project page at https://video-3dgs-project.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23353 2025-04-01 cs.CV cs.AI 57%

Object Isolated Attention for Consistent Story Visualization

Xiangyang Luo, Junhao Cheng, Yifan Xie, Xin Zhang, Tao Feng, Zhou Liu, Fei Ma, Fei Yu

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

Comments 6 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.15262 2025-04-01 cs.CV 57%

MovieBench: A Hierarchical Movie Level Dataset for Long Video Generation

Weijia Wu, Mingyu Liu, Zeyu Zhu, Xi Xia, Haoen Feng, Wen Wang, Kevin Qinghong Lin, Chunhua Shen, Mike Zheng Shou

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

Comments The project website is at: https://weijiawu.github.io/MovieBench/. Code: https://github.com/showlab/MovieBecnh

Journal ref CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.12223 2025-03-31 cs.CV cs.AI 57%

Can video generation replace cinematographers? Research on the cinematic language of generated video

Xiaozhe Li, Kai WU, Siyi Yang, YiZhan Qu, Guohua. Zhang, Zhiyu Chen, Jiayao Li, Jiangchuan Mu, Xiaobin Hu, Wen Fang, Mingliang Xiong, Hao Deng, Qingwen Liu, Gang Li, Bin He

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.21172 2025-03-28 cs.CV 57%

Model as a Game: On Numerical and Spatial Consistency for Generative Games

Jingye Chen, Yuzhong Zhao, Yupan Huang, Lei Cui, Li Dong, Tengchao Lv, Qifeng Chen, Furu Wei

专题命中 个性化与一致性 :image generation(abstract);分类 cs.CV

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.21104 2025-03-28 cs.CV 57%

StyledStreets: Multi-style Street Simulator with Spatial and Temporal Consistency

Yuyin Chen, Yida Wang, Xueyang Zhang, Kun Zhan, Peng Jia, Yifei Zhan, Xianpeng Lang

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.20785 2025-03-27 cs.CV 57%

Free4D: Tuning-free 4D Scene Generation with Spatial-Temporal Consistency

Tianqi Liu, Zihao Huang, Zhaoxi Chen, Guangcong Wang, Shoukang Hu, Liao Shen, Huiqiang Sun, Zhiguo Cao, Wei Li, Ziwei Liu

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

Comments Project Page: https://free4d.github.io/ , Code: https://github.com/TQTQliu/Free4D

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.19793 2025-03-27 cs.CV 57%

In the Blink of an Eye: Instant Game Map Editing using a Generative-AI Smart Brush

Vitaly Gnatyuk, Valeriia Koriukina, Ilya Levoshevich, Pavel Nurminskiy, Guenter Wallner

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07390 2025-03-24 cs.CV 57%

PersonaBooth: Personalized Text-to-Motion Generation

Boeun Kim, Hea In Jeong, JungHoon Sung, Yihua Cheng, Jeongmin Lee, Ju Yong Chang, Sang-Il Choi, Younggeun Choi, Saim Shin, Jungho Kim, Hyung Jin Chang

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.17064 2025-03-24 cs.CV cs.AI cs.LG 57%

Instant Adversarial Purification with Adversarial Consistency Distillation

Chun Tong Lei, Hon Ming Yam, Zhongliang Guo, Yifei Qian, Chun Pong Lau

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

Comments Accepted by CVPR2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.05279 2025-03-21 cs.CV 57%

Perturb-and-Revise: Flexible 3D Editing with Generative Trajectories

Susung Hong, Johanna Karras, Ricardo Martin-Brualla, Ira Kemelmacher-Shlizerman

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

Comments CVPR 2025. Project page: https://susunghong.github.io/Perturb-and-Revise

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.14928 2025-03-20 cs.CV cs.AI cs.SD eess.AS 57%

Shushing! Let's Imagine an Authentic Speech from the Silent Video

Jiaxin Ye, Hongming Shan

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

Comments Project Page: https://imagintalk.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01715 2025-03-20 cs.CV cs.AI 57%

KeyFace: Expressive Audio-Driven Facial Animation for Long Sequences via KeyFrame Interpolation

Antoni Bigata, Michał Stypułkowski, Rodrigo Mira, Stella Bounareli, Konstantinos Vougioukas, Zoe Landgraf, Nikita Drobyshev, Maciej Zieba, Stavros Petridis, Maja Pantic

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

Comments CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12124 2025-03-18 cs.CV 57%

Z-Magic: Zero-shot Multiple Attributes Guided Image Creator

Yingying Deng, Xiangyu He, Fan Tang, Weiming Dong

专题命中 个性化与一致性 :image generation(abstract);分类 cs.CV

Comments CVPR2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10614 2025-03-14 cs.CV 57%

ConsisLoRA: Enhancing Content and Style Consistency for LoRA-based Style Transfer

Bolin Chen, Baoquan Zhao, Haoran Xie, Yi Cai, Qing Li, Xudong Mao

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10391 2025-03-14 cs.CV cs.AI 57%

CINEMA: Coherent Multi-Subject Video Generation via MLLM-Based Guidance

Yufan Deng, Xun Guo, Yizhi Wang, Jacob Zhiyuan Fang, Angtian Wang, Shenghai Yuan, Yiding Yang, Bo Liu, Haibin Huang, Chongyang Ma

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏