arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 1263 信号源:cs.CV, cs.GR, cs.MM

1. 个性化与一致性 1263 篇

2504.17349 2025-08-05 cs.CV cs.IR 85%

DRC: Enhancing Personalized Image Generation via Disentangled Representation Composition

Yiyan Xu, Wuqiang Zheng, Wenjie Wang, Fengbin Zhu, Xinting Hu, Yang Zhang, Fuli Feng, Tat-Seng Chua

机构 * University of Science and Technology of China(中国科学技术大学) National University of Singapore(新加坡国立大学) Nanyang Technological University(南洋理工大学)

专题命中 个性化与一致性 :image generation(title,abstract);diffusion(abstract);personalized generation(abstract);分类 cs.CV

Comments Accepted for publication in ACM MM'25

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16095 2025-07-23 cs.CV 85%

Improving Personalized Image Generation through Social Context Feedback

Parul Gupta, Abhinav Dhall, Thanh-Toan Do

机构 * Monash University(墨尔本大学)

专题命中 个性化与一致性 :image generation(title,abstract);diffusion(abstract);personalized generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.18919 2025-06-02 cs.CV 85%

TheaterGen: Character Management with LLM for Consistent Multi-turn Image Generation

Junhao Cheng, Baiqiao Yin, Kaixin Cai, Minbin Huang, Hanhui Li, Yuxin He, Xi Lu, Yue Li, Yifei Li, Yuhao Cheng, Yiqiang Yan, Xiaodan Liang

机构 * Shenzhen Campus of Sun Yat-sen University(孙中山大学深圳校区) The Chinese University of Hong Kong(香港中文大学) Lenovo Research(联想研究院)

专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21911 2025-05-29 cs.CV 85%

AlignGen: Boosting Personalized Image Generation with Cross-Modality Prior Alignment

Yiheng Lin, Shifang Zhao, Ting Liu, Xiaochao Qu, Luoqi Liu, Yao Zhao, Yunchao Wei

机构 * Institute of Information Science, Beijing Jiaotong University(信息科学学院,北京交通大学) MT Lab, Meitu Inc.(美图实验室,美图公司)

专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.05081 2025-05-13 cs.CV 85%

PIDiff: Image Customization for Personalized Identities with Diffusion Models

Jinyu Gu, Haipeng Liu, Meng Wang, Yang Wang

机构 * School of Computer Science and Information Engineering, Hefei University of Technology(计算机科学与信息工程学院,合肥工业大学)

专题命中 个性化与一致性 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments 9 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.08091 2025-05-02 cs.CV 85%

EZIGen: Enhancing zero-shot personalized image generation with precise subject encoding and decoupled guidance

Zicheng Duan, Yuxuan Ding, Chenhui Gou, Ziqin Zhou, Ethan Smith, Lingqiao Liu

机构 * AIML, University of Adelaide(人工智能实验室,阿德莱德大学) Xidian University(西安电子科技大学) Monash University(墨尔本大学)

专题命中 个性化与一致性 :image generation(title,abstract);diffusion(abstract);personalized generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07703 2025-03-12 cs.CV 85%

Seedream 2.0: A Native Chinese-English Bilingual Image Generation Foundation Model

Lixue Gong, Xiaoxia Hou, Fanshi Li, Liang Li, Xiaochen Lian, Fei Liu, Liyang Liu, Wei Liu, Wei Lu, Yichun Shi, Shiqi Sun, Yu Tian, Zhi Tian, Peng Wang, Xun Wang, Ye Wang, Guofeng Wu, Jie Wu, Xin Xia, Xuefeng Xiao, Linjie Yang, Zhonghua Zhai, Xinyu Zhang, Qi Zhang, Yuwei Zhang, Shijia Zhao, Jianchao Yang, Weilin Huang

专题命中 个性化与一致性 :image generation(title,abstract);diffusion(abstract);image editing(abstract);分类 cs.CV

Comments Official Page: https://team.doubao.com/tech/seedream

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.06568 2025-03-11 cs.CV cs.AI 85%

Conceptrol: Concept Control of Zero-shot Personalized Image Generation

Qiyuan He, Angela Yao

专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.02084 2025-03-11 cs.CV 85%

ResAdapter: Domain Consistent Resolution Adapter for Diffusion Models

Jiaxiang Cheng, Pan Xie, Xin Xia, Jiashi Li, Jie Wu, Yuxi Ren, Huixia Li, Xuefeng Xiao, Min Zheng, Lean Fu

专题命中 个性化与一致性 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments Accepted by AAAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13997 2025-02-21 cs.GR 85%

SigStyle: Signature Style Transfer via Personalized Text-to-Image Models

Ye Wang, Tongyuan Bai, Xuping Xie, Zili Yi, Yilin Wang, Rui Ma

专题命中 个性化与一致性 :text-to-image(title,abstract);image generation(abstract);diffusion(abstract);分类 cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13081 2025-02-19 cs.CV 85%

Personalized Image Generation with Deep Generative Models: A Decade Survey

Yuxiang Wei, Yiheng Zheng, Yabo Zhang, Ming Liu, Zhilong Ji, Lei Zhang, Wangmeng Zuo

专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV

Comments 39 pages; under submission; more information: https://github.com/csyxwei/Awesome-Personalized-Image-Generation

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.05895 2025-02-11 cs.CV 85%

Beyond Fine-Tuning: A Systematic Study of Sampling Techniques in Personalized Image Generation

Vera Soboleva, Maksim Nakhodnov, Aibek Alanov

专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV

Comments The first two authors contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.19533 2025-01-07 cs.CV cs.AI 85%

P3S-Diffusion:A Selective Subject-driven Generation Framework via Point Supervision

Junjie Hu, Shuyong Gao, Lingyi Hong, Qishan Wang, Yuzhou Zhao, Yan Wang, Wenqiang Zhang

专题命中 个性化与一致性 :diffusion(title,abstract);image generation(abstract);inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.17920 2024-12-19 cs.CV 85%

Resolving Multi-Condition Confusion for Finetuning-Free Personalized Image Generation

Qihan Huang, Siming Fu, Jinlong Liu, Hao Jiang, Yipeng Yu, Jie Song

专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.17786 2024-11-28 cs.CV cs.AI cs.LG 85%

DreamCache: Finetuning-Free Lightweight Personalized Image Generation via Feature Caching

Emanuele Aiello, Umberto Michieli, Diego Valsesia, Mete Ozay, Enrico Magli

专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV

Comments 16 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.06740 2024-11-18 cs.CV cs.AI 85%

DiffLoRA: Generating Personalized Low-Rank Adaptation Weights with Diffusion

Yujia Wu, Yiming Shi, Jiwei Wei, Chengwei Sun, Yang Yang, Heng Tao Shen

专题命中 个性化与一致性 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments 9 pages,8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.10983 2024-07-23 cs.CV 85%

OMG: Occlusion-friendly Personalized Multi-concept Generation in Diffusion Models

Zhe Kong, Yong Zhang, Tianyu Yang, Tao Wang, Kaihao Zhang, Bizhu Wu, Guanying Chen, Wei Liu, Wenhan Luo

专题命中 个性化与一致性 :diffusion(title);image generation(abstract);text-to-image(abstract);personalized generation(abstract)

Comments ECCV 2024; Homepage: https://kongzhecn.github.io/omg-project/ Github: https://github.com/kongzhecn/OMG/

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.17236 2024-06-26 cs.CV 85%

LIPE: Learning Personalized Identity Prior for Non-rigid Image Editing

Aoyang Liu, Qingnan Fan, Shuai Qin, Hong Gu, Yansong Tang

专题命中 个性化与一致性 :image editing(title,abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.05674 2024-04-09 cs.CV 85%

MoMA: Multimodal LLM Adapter for Fast Personalized Image Generation

Kunpeng Song, Yizhe Zhu, Bingchen Liu, Qing Yan, Ahmed Elgammal, Xiao Yang

专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.09368 2024-03-21 cs.CV cs.AI 85%

Magic-Me: Identity-Specific Video Customized Diffusion

Ze Ma, Daquan Zhou, Chun-Hsiao Yeh, Xue-She Wang, Xiuyu Li, Huanrui Yang, Zhen Dong, Kurt Keutzer, Jiashi Feng

专题命中 个性化与一致性 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments Project Page at https://magic-me-webpage.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.11284 2024-03-19 cs.CV 85%

Fast Personalized Text-to-Image Syntheses With Attention Injection

Yuxuan Zhang, Yiren Song, Jinpeng Yu, Han Pan, Zhongliang Jing

专题命中 个性化与一致性 :text-to-image(title,abstract);image generation(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.17412 2024-02-29 cs.CV 85%

DiffuseKronA: A Parameter Efficient Fine-tuning Method for Personalized Diffusion Models

Shyam Marjit, Harshit Singh, Nityanand Mathur, Sayak Paul, Chia-Mu Yu, Pin-Yu Chen

专题命中 个性化与一致性 :diffusion(title,abstract);text-to-image(abstract);image synthesis(abstract);分类 cs.CV

Comments Project Page: https://diffusekrona.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.01952 2024-01-05 cs.CV cs.AI cs.CL 85%

Instruct-Imagen: Image Generation with Multi-modal Instruction

Hexiang Hu, Kelvin C. K. Chan, Yu-Chuan Su, Wenhu Chen, Yandong Li, Kihyuk Sohn, Yang Zhao, Xue Ben, Boqing Gong, William Cohen, Ming-Wei Chang, Xuhui Jia

专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV

Comments 20 pages, 18 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.02421 2023-11-21 cs.CV 85%

DragonDiffusion: Enabling Drag-style Manipulation on Diffusion Models

Chong Mou, Xintao Wang, Jiechong Song, Ying Shan, Jian Zhang

专题命中 个性化与一致性 :diffusion(title,abstract);text-to-image(abstract);image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.13975 2023-09-26 cs.CV 85%

Diverse Semantic Image Editing with Style Codes

Hakan Sivuk, Aysegul Dundar

专题命中 个性化与一致性 :image editing(title,abstract);image generation(abstract);inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.10431 2023-05-23 cs.CV 85%

FastComposer: Tuning-Free Multi-Subject Image Generation with Localized Attention

Guangxuan Xiao, Tianwei Yin, William T. Freeman, Frédo Durand, Song Han

专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV

Comments The first two authors contributed equally to this work

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10156 2025-10-14 cs.CV 84%

ReMix: Towards a Unified View of Consistent Character Generation and Editing

Benjia Zhou, Bin Fu, Pei Cheng, Yanru Wang, Jiayuan Fan, Tao Chen

机构 * Tencent GYLab(腾讯GY实验室) Fudan University(复旦大学)

专题命中 个性化与一致性 :image generation(abstract);text-to-image(abstract);diffusion(abstract);image editing(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11885 2026-07-14 cs.CV cs.GR 新提交 84%

Latent-Identity Tuning in Text-to-Image Personalization Models

文本到图像个性化模型中的潜在身份调整

Daniel Garibi, Ronen Kamenetsky, Hadar Averbuch-Elor, Daniel Cohen-Or, Or Patashnik

机构 * Tel Aviv University(特拉维夫大学) Cornell University(康奈尔大学)

专题命中 个性化与一致性 :text-to-image(title,abstract);image editing(abstract);分类 cs.CV、cs.GR

AI总结 研究文本到图像个性化模型中细粒度身份调整问题,利用预训练冻结编码器潜在空间,无需额外训练,通过揭示潜在语义方向实现局部、细粒度且语义连贯的面部编辑,经实验验证有效。

Comments Project page at: https://garibida.github.io/IdentityTuning/

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18263 2026-04-23 cs.LG cs.CV cs.GR 84%

From Competition to Synergy: Unlocking Reinforcement Learning for Subject-Driven Image Generation

从竞争到协同:解锁受主体驱动的图像生成中的强化学习

Ziwei Huang, Ying Shu, Hao Fang, Quanyu Long, Wenya Wang, Qiushi Guo, Tiezheng Ge, Leilei Gan

机构 * Zhejiang University(浙江大学) Alibaba Group(阿里巴巴集团) Nanyang Technological University(南洋理工大学)

专题命中 个性化与一致性 :image generation(title,abstract);diffusion(abstract);分类 cs.CV、cs.GR

AI总结 本文提出Customized-GRPO方法,通过Synergy-Aware Reward Shaping和Time-Aware Dynamic Weighting解决强化学习中身份保持与提示遵循的平衡问题,提升图像生成质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06483 2025-06-10 cs.GR cs.AI cs.CV cs.LG eess.IV 84%

Noise Consistency Regularization for Improved Subject-Driven Image Synthesis

Yao Ni, Song Wen, Piotr Koniusz, Anoop Cherian

专题命中 个性化与一致性 :image synthesis(title,abstract);diffusion(abstract);分类 cs.CV、cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏