arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 1266 信号源:cs.CV, cs.GR, cs.MM

1. 个性化与一致性 1266 篇

2505.11703 2025-05-20 cs.CV 70%

LoFT: LoRA-fused Training Dataset Generation with Few-shot Guidance

Jae Myung Kim, Stephan Alaniz, Cordelia Schmid, Zeynep Akata

机构 * University of Tübingen(图宾根大学) Helmholtz Munich(马克斯·普朗克研究所(慕尼黑)) Technical University of Munich(慕尼黑技术大学) Munich Center for Machine Learning(慕尼黑机器学习中心) LTCI, Télécom Paris, Institut Polytechnique de Paris, France(巴黎电信学院(LTCI)、巴黎理工学院) Inria, Ecole normale supérieure, CNRS, PSL Research University(法国国家信息与自动化技术研究院(Inria)、巴黎高等师范学校、国家科学研究中心(CNRS)、巴黎科学理工大学(PSL Research University))

专题命中 个性化与一致性 :image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.04722 2025-05-16 cs.CV 70%

TactileNet: Bridging the Accessibility Gap with AI-Generated Tactile Graphics for Individuals with Vision Impairment

Adnan Khan, Alireza Choubineh, Mai A. Shaaban, Abbas Akkasi, Majid Komeili

机构 * School of Computer Science, Carleton University(卡罗林大学计算机科学学院) Mohamed bin Zayed University of Artificial Intelligence(人工智能穆罕默德·本·扎耶德大学)

专题命中 个性化与一致性 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.01823 2025-05-14 cs.CV cs.AI cs.ET 70%

PhytoSynth: Leveraging Multi-modal Generative Models for Crop Disease Data Generation with Novel Benchmarking and Prompt Engineering Approach

Nitin Rai, Arnold W. Schumann, Nathan Boyd

机构 * Gulf Coast Research and Education Center (GCREC), University of Florida(佛罗里达大学 Gulf Coast Research and Education Center) Citrus Research and Education Center (CREC), University of Florida(佛罗里达大学 Citrus Research and Education Center)

专题命中 个性化与一致性 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.04915 2025-05-09 cs.CV 70%

GlyphMastero: A Glyph Encoder for High-Fidelity Scene Text Editing

Tong Wang, Ting Liu, Xiaochao Qu, Chengjing Wu, Luoqi Liu, Xiaolin Hu

机构 * MT Lab, Meitu Inc.(美图公司MT实验室) Department of Computer Science and Technology, BNRist, IDG/McGovern Institute for Brain Research, Tsinghua University(清华大学计算机科学与技术系)

专题命中 个性化与一致性 :diffusion(abstract);image editing(abstract);分类 cs.CV

Comments CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.08296 2025-04-14 cs.CV 70%

Generative AI for Film Creation: A Survey of Recent Advances

Ruihan Zhang, Borou Yu, Jiajian Min, Yetong Xin, Zheng Wei, Juncheng Nemo Shi, Mingzhen Huang, Xianghao Kong, Nix Liu Xin, Shanshan Jiang, Praagya Bahuguna, Mark Chan, Khushi Hora, Lijian Yang, Yongqi Liang, Runhe Bian, Yunlei Liu, Isabela Campillo Valencia, Patricia Morales Tredinick, Ilia Kozlov, Sijia Jiang, Peiwen Huang, Na Chen, Xuanxuan Liu, Anyi Rao

专题命中 个性化与一致性 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

Comments Accepted at CVPR 2025 CVEU workshop: AI for Creative Visual Content Generation Editing and Understanding

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22225 2025-03-31 cs.CV 70%

Follow Your Motion: A Generic Temporal Consistency Portrait Editing Framework with Trajectory Guidance

Haijie Yang, Zhenyu Zhang, Hao Tang, Jianjun Qian, Jian Yang

专题命中 个性化与一致性 :diffusion(abstract);image editing(abstract);分类 cs.CV

Comments https://anonymous-hub1127.github.io/FYM.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01441 2025-03-26 cs.CV cs.LG 70%

Improved Training Technique for Latent Consistency Models

Quan Dao, Khanh Doan, Di Liu, Trung Le, Dimitris Metaxas

专题命中 个性化与一致性 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

Comments Accepted at ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15406 2025-03-25 cs.CV 70%

Visual Persona: Foundation Model for Full-Body Human Customization

Jisu Nam, Soowon Son, Zhan Xu, Jing Shi, Difan Liu, Feng Liu, Aashish Misraa, Seungryong Kim, Yang Zhou

专题命中 个性化与一致性 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

Comments CVPR 2025, Project page is available at https://cvlab-kaist.github.io/Visual-Persona

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16025 2025-03-21 cs.CV cs.AI 70%

Single Image Iterative Subject-driven Generation and Editing

Yair Shpitzer, Gal Chechik, Idan Schwartz

专题命中 个性化与一致性 :image generation(abstract);image editing(abstract);分类 cs.CV

Comments Project page is at https://siso-paper.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.14793 2025-03-21 cs.CV 70%

Style-Friendly SNR Sampler for Style-Driven Generation

Jooyoung Choi, Chaehun Shin, Yeongtak Oh, Heeseung Kim, Jungbeom Lee, Sungroh Yoon

专题命中 个性化与一致性 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

Comments Project page: https://stylefriendly.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.19785 2025-02-18 cs.CR cs.CV cs.LG 70%

How to Backdoor Consistency Models?

Chengen Wang, Murat Kantarcioglu

专题命中 个性化与一致性 :image generation(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.15674 2024-12-23 cs.CV 70%

PersonaMagic: Stage-Regulated High-Fidelity Face Customization with Tandem Equilibrium

Xinzhe Li, Jiahui Zhan, Shengfeng He, Yangyang Xu, Junyu Dong, Huaidong Zhang, Yong Du

专题命中 个性化与一致性 :image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments This paper is accepted by AAAI 2025. The code is available at https://github.com/xzhe-Vision/PersonaMagic

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.12154 2024-12-17 cs.CV 70%

StyleBooth: Image Style Editing with Multimodal Instruction

Zhen Han, Chaojie Mao, Zeyinzi Jiang, Yulin Pan, Jingfeng Zhang

专题命中 个性化与一致性 :diffusion(abstract);image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.08645 2024-12-12 cs.CV 70%

ObjectMate: A Recurrence Prior for Object Insertion and Subject-Driven Generation

Daniel Winter, Asaf Shul, Matan Cohen, Dana Berman, Yael Pritch, Alex Rav-Acha, Yedid Hoshen

专题命中 个性化与一致性 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06295 2024-12-10 cs.CV 70%

See Further When Clear: Curriculum Consistency Model

Yunpeng Liu, Boxiao Liu, Yi Zhang, Xingzhong Hou, Guanglu Song, Yu Liu, Haihang You

专题命中 个性化与一致性 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.03962 2024-12-09 cs.LG cs.CV 70%

Local Curvature Smoothing with Stein's Identity for Efficient Score Matching

Genki Osada, Makoto Shing, Takashi Nishide

专题命中 个性化与一致性 :image generation(abstract);diffusion(abstract);分类 cs.CV

Comments Accepted at NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.18407 2024-12-05 cs.LG cs.CV 70%

Phased Consistency Models

Fu-Yun Wang, Zhaoyang Huang, Alexander William Bergman, Dazhong Shen, Peng Gao, Michael Lingelbach, Keqiang Sun, Weikang Bian, Guanglu Song, Yu Liu, Xiaogang Wang, Hongsheng Li

专题命中 个性化与一致性 :image generation(abstract);diffusion(abstract);分类 cs.CV

Comments NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.17225 2024-12-05 cs.CV 70%

4DGen: Grounded 4D Content Generation with Spatial-temporal Consistency

Yuyang Yin, Dejia Xu, Zhangyang Wang, Yao Zhao, Yunchao Wei

专题命中 个性化与一致性 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

Comments Project page: https://vita-group.github.io/4DGen/

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.06807 2024-11-20 cs.LG cs.CV stat.ML 70%

Multistep Consistency Models

Jonathan Heek, Emiel Hoogeboom, Tim Salimans

专题命中 个性化与一致性 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.07433 2024-11-19 cs.CV cs.AI 70%

MagicFace: Training-free Universal-Style Human Image Customized Synthesis

Yibin Wang, Weizhong Zhang, Cheng Jin

专题命中 个性化与一致性 :diffusion(abstract);image synthesis(abstract);分类 cs.CV

Comments project page: https://codegoat24.github.io/MagicFace

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.18537 2024-10-25 cs.CV 70%

Beyond Color and Lines: Zero-Shot Style-Specific Image Variations with Coordinated Semantics

Jinghao Hu, Yuhe Zhang, GuoHua Geng, Liuyuxin Yang, JiaRui Yan, Jingtao Cheng, YaDong Zhang, Kang Li

专题命中 个性化与一致性 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

Comments 13 pages,6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.00769 2024-10-17 cs.CV cs.LG 70%

AnimateLCM: Computation-Efficient Personalized Style Video Generation without Personalized Video Data

Fu-Yun Wang, Zhaoyang Huang, Weikang Bian, Xiaoyu Shi, Keqiang Sun, Guanglu Song, Yu Liu, Hongsheng Li

专题命中 个性化与一致性 :image generation(abstract);diffusion(abstract);分类 cs.CV

Comments Accepted as a Short Paper by SIGGRAPH ASIA 2024 Technical Communications. This is a short version of the original work. Project Page: https://animatelcm.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.08192 2024-10-11 cs.CV 70%

HybridBooth: Hybrid Prompt Inversion for Efficient Subject-Driven Generation

Shanyan Guan, Yanhao Ge, Ying Tai, Jian Yang, Wei Li, Mingyu You

专题命中 个性化与一致性 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

Comments ECCV 2024, the project page: https://sites.google.com/view/hybridbooth

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.05259 2024-10-08 cs.CV 70%

GS-VTON: Controllable 3D Virtual Try-on with Gaussian Splatting

Yukang Cao, Masoud Hadi, Liang Pan, Ziwei Liu

专题命中 个性化与一致性 :diffusion(abstract);image editing(abstract);分类 cs.CV

Comments 21 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.11641 2024-08-26 cs.CV 70%

Arc2Face: A Foundation Model for ID-Consistent Human Faces

Foivos Paraperas Papantoniou, Alexandros Lattas, Stylianos Moschoglou, Jiankang Deng, Bernhard Kainz, Stefanos Zafeiriou

专题命中 个性化与一致性 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

Comments ECCV 2024 (Oral), 29 pages, 20 figures. Project page: https://arc2face.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.15559 2024-08-05 cs.CV cs.AI 70%

An Optimization Framework to Enforce Multi-View Consistency for Texturing 3D Meshes

Zhengyi Zhao, Chen Song, Xiaodong Gu, Yuan Dong, Qi Zuo, Weihao Yuan, Liefeng Bo, Zilong Dong, Qixing Huang

专题命中 个性化与一致性 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.12009 2024-07-18 cs.CV cs.AI 70%

Using Multimodal Foundation Models and Clustering for Improved Style Ambiguity Loss

James Baker

专题命中 个性化与一致性 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.11433 2024-07-17 cs.CV 70%

CycleHOI: Improving Human-Object Interaction Detection with Cycle Consistency of Detection and Generation

Yisen Wang, Yao Teng, Limin Wang

专题命中 个性化与一致性 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.10429 2024-06-18 cs.CV cs.AI 70%

Consistency-diversity-realism Pareto fronts of conditional image generative models

Pietro Astolfi, Marlene Careil, Melissa Hall, Oscar Mañas, Matthew Muckley, Jakob Verbeek, Adriana Romero Soriano, Michal Drozdzal

专题命中 个性化与一致性 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.08953 2024-06-14 cs.CV cs.LG 70%

Preserving Identity with Variational Score for General-purpose 3D Editing

Duong H. Le, Tuan Pham, Aniruddha Kembhavi, Stephan Mandt, Wei-Chiu Ma, Jiasen Lu

专题命中 个性化与一致性 :diffusion(abstract);image editing(abstract);分类 cs.CV

Comments 22 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏