arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 1263 信号源:cs.CV, cs.GR, cs.MM

1. 个性化与一致性 1263 篇

2407.06187 2024-07-09 cs.CV cs.GR 92%

JeDi: Joint-Image Diffusion Models for Finetuning-Free Personalized Text-to-Image Generation

Yu Zeng, Vishal M. Patel, Haochen Wang, Xun Huang, Ting-Chun Wang, Ming-Yu Liu, Yogesh Balaji

专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV、cs.GR

Comments CVPR 24

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.04215 2025-03-07 cs.CV 92%

Energy-Guided Optimization for Personalized Image Editing with Pretrained Text-to-Image Diffusion Models

Rui Jiang, Xinghe Fu, Guangcong Zheng, Teng Li, Taiping Yao, Xi Li

专题命中 个性化与一致性 :diffusion(title,abstract);image editing(title,abstract);text-to-image(title);image generation(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07173 2026-07-09 cs.CV 新提交 90%

Stage-Aware Adaptation and Distribution Calibration for Subject-Driven Personalized Text-to-Image Generation

用于主题驱动的个性化文本到图像生成的阶段感知适应与分布校准

Wenyan Xu, Alizer Wong

机构 * School of Computer Science, Guangdong University of Technology(广东工业大学计算机学院) School of Computer Science, Peking University(北京大学计算机学院) ManXis(未知)

专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(title,abstract);diffusion(abstract);personalized generation(abstract)

AI总结 研究主题驱动的个性化文本到图像生成问题,提出将其分解为训练端的 SPaRa 和推理端的 DCAL 两个互补组件的框架 SPaRa-DCAL,通过理论分析和实验表明该框架能提升相关指标,并指出应综合多方面评估个性化生成。

Comments 16 pages, 4 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05816 2026-06-09 cs.CV cs.AI 版本更新 90%

Emotion-Aware Image Generation from Korean Diary Text via LLM-based Prompt Translation and LoRA Fine-Tuning

基于LLM提示翻译和LoRA微调的韩语日记文本情感感知图像生成

Jihun Cho, Soo-Yeon Jeong, Sun-Young Ihm

机构 * KAIST(韩国科学技术院)

专题命中 个性化与一致性 :diffusion(summary_cn,abstract);image generation(title,abstract);text-to-image(abstract);分类 cs.CV

AI总结 提出一种情感感知文本到图像流水线,利用Qwen3-8B识别短日记中的隐含情感,并通过LoRA微调Stable Diffusion 3.5 Medium生成儿童手绘风格图像,同时探讨情感触发词的影响及CLIP Score作为评估指标的局限性。

Comments 4 pages, 4 figures, 2 tables, MITA 2026

Journal ref Proc. Int. Conf. Multimedia, Information Technology and its Applications (MITA), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19874 2025-05-27 cs.CV cs.AI cs.MM 90%

StyleAR: Customizing Multimodal Autoregressive Model for Style-Aligned Text-to-Image Generation

Yi Wu, Lingting Zhu, Shengju Qian, Lei Liu, Wandi Qiao, Lequan Yu, Bin Li

机构 * University of Science and Technology of China(中国科学技术大学) The University of Hong Kong(香港大学) The Chinese University of Hong Kong(香港中文大学)

专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(title,abstract);image editing(abstract);分类 cs.CV、cs.MM

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09244 2026-08-11 cs.CV 新提交 89%

In-Loop Model Adaptation with Coupled Latent-Noise Guidance for High-Fidelity Subject-Driven Text-to-Image Generation

用于高保真主体驱动文本到图像生成的耦合潜在噪声引导的循环内模型适配

Yushun Tang, Weiming Chen, Siyi Liu, Yi Zhang, Feng Wu, Zhihai He

机构 * Southern University of Science and Technology(南方科技大学) University of Science and Technology of China(中国科学技术大学) Pengcheng Lab(鹏城实验室)

专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

AI总结 本研究针对主体驱动文本到图像生成中参考图像变化时模型难适配且难保持主体身份的问题,提出IMA方法,通过耦合潜在噪声损失引导循环内模型适配,提升了生成性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07554 2026-02-10 cs.CV 89%

FlexID: Training-Free Flexible Identity Injection via Intent-Aware Modulation for Text-to-Image Generation

FlexID: 无训练灵活身份注入 via 意图感知调制 for 文本到图像生成

Guandong Li, Yijun Ding

机构 * iFLYTEK

专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

AI总结 FlexID通过意图感知调制实现无训练灵活身份注入,提升文本到图像生成中身份保真度与文本适应性的平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06499 2025-09-19 cs.CV 89%

TIDE: Achieving Balanced Subject-Driven Image Generation via Target-Instructed Diffusion Enhancement

Jibai Lin, Bo Ma, Yating Yang, Xi Zhou, Rong Ma, Turghun Osman, Ahtamjan Ahmat, Rui Dong, Lei Wang

机构 * Xinjiang Technical Institute of Physics & Chemistry(新疆物理化学技术研究所) University of Chinese Academy of Sciences(中国科学院大学) Xinjiang Laboratory of Minority Speech and Language Information Processing(新疆少数民族语言信息处理实验室)

专题命中 个性化与一致性 :image generation(title,abstract);diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.11990 2025-07-17 cs.CV 89%

ID-EA: Identity-driven Text Enhancement and Adaptation with Textual Inversion for Personalized Text-to-Image Generation

Hyun-Jun Jin, Young-Eun Kim, Seong-Whan Lee

机构 * Department of Artificial Intelligence, Korea University(人工智能系,韩国大学)

专题命中 个性化与一致性 :text-to-image(title,abstract);image generation(title);diffusion(abstract);personalized generation(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22360 2025-05-29 cs.CV 89%

Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion

Kewen Chen, Xiaobin Hu, Wenqi Ren

机构 * School of Cyber Science and Technology, Shenzhen Campus of Sun Yat-sen University(中山大学网络科学与技术学院深圳校区) Technische Universität München(慕尼黑技术大学)

专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(title,abstract);inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.15309 2025-04-23 cs.CV 89%

LLM-Enabled Style and Content Regularization for Personalized Text-to-Image Generation

Anran Yu, Wei Feng, Yaochen Zhang, Xiang Li, Lei Meng, Lei Wu, Xiangxu Meng

机构 * School of Software, Shandong University(软件学院,山东大学) Shandong Research Institute of Shandong University(山东大学山东研究院) Inspur Technology(Inspur技术公司)

专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.05806 2024-07-30 cs.CV 89%

MasterWeaver: Taming Editability and Face Identity for Personalized Text-to-Image Generation

Yuxiang Wei, Zhilong Ji, Jinfeng Bai, Hongzhi Zhang, Lei Zhang, Wangmeng Zuo

专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

Comments ECCV 2024. Our code can be found at https://github.com/csyxwei/MasterWeaver

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.15449 2024-04-25 cs.CV cs.AI 89%

ID-Aligner: Enhancing Identity-Preserving Text-to-Image Generation with Reward Feedback Learning

Weifeng Chen, Jiacheng Zhang, Jie Wu, Hefeng Wu, Xuefeng Xiao, Liang Lin

专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.03374 2024-02-28 cs.CV 89%

DisenBooth: Identity-Preserving Disentangled Tuning for Subject-Driven Text-to-Image Generation

Hong Chen, Yipeng Zhang, Simin Wu, Xin Wang, Xuguang Duan, Yuwei Zhou, Wenwu Zhu

专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.04725 2024-02-09 cs.CV cs.GR cs.LG 88%

AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning

Yuwei Guo, Ceyuan Yang, Anyi Rao, Zhengyang Liang, Yaohui Wang, Yu Qiao, Maneesh Agrawala, Dahua Lin, Bo Dai

专题命中 个性化与一致性 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV、cs.GR

Comments Codes and Supplementary Material: https://github.com/guoyww/AnimateDiff

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.12242 2023-03-16 cs.CV cs.GR cs.LG 88%

DreamBooth: Fine Tuning Text-to-Image Diffusion Models for Subject-Driven Generation

Nataniel Ruiz, Yuanzhen Li, Varun Jampani, Yael Pritch, Michael Rubinstein, Kfir Aberman

专题命中 个性化与一致性 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV、cs.GR

Comments Published at CVPR 2023. Project page: https://dreambooth.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20725 2026-04-14 cs.CV 88%

Premier: Personalized Preference Modulation with Learnable User Embedding in Text-to-Image Generation

Premier: 基于可学习用户嵌入的个性化偏好调节在文本到图像生成中

Zihao Wang, Yuxiang Wei, Xinpeng Zhou, Tianyu Zhang, Tao Liang, Yalong Bai, Hongzhi Zhang, Wangmeng Zuo

机构 * Harbin Institute of Technology(哈尔滨工业大学) Duxiaoman(度小满)

专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(title,abstract);分类 cs.CV

AI总结 Premier通过可学习用户嵌入和偏好适配器实现个性化图像生成,引入分散损失提升用户偏好区分度,实验显示其在偏好对齐和文本一致性上表现更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18533 2026-02-24 cs.CV 88%

Morphological Addressing of Identity Basins in Text-to-Image Diffusion Models

文本到图像扩散模型中身份盆地的形态学分析

Andrew Fraser

专题命中 个性化与一致性 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

AI总结 通过形态学描述符和提示层面的音感结构,研究揭示了文本到图像扩散模型中身份盆地的系统性导航梯度,展示了身份稳定性和新视觉概念的生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18635 2025-12-23 cs.CV 88%

Uni-Neur2Img: Unified Neural Signal-Guided Image Generation, Editing, and Stylization via Diffusion Transformers

Uni-Neur2Img:通过扩散变换器实现神经信号引导的图像生成、编辑和风格化

Xiyue Bai, Ronghao Yu, Jia Xiu, Pengfei Zhou, Jie Xia, Peng Ji

机构 * Fudan University(复旦大学) Zhejiang University(浙江大学) National University of Singapore(新加坡国立大学)

专题命中 个性化与一致性 :image generation(title,abstract);diffusion(title);image editing(abstract);分类 cs.CV

AI总结 Uni-Neur2Img通过扩散变换器实现神经信号引导的图像生成、编辑和风格化,提供统一且高效的解决方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06802 2025-09-30 cs.CV 88%

Training-Free Diffusion Framework for Stylized Image Generation with Identity Preservation

Mohammad Ali Rezaei, Helia Hajikazem, Saeed Khanehgir, Mahdi Javanmardi

机构 * Computer Vision Group, Part AI Research Center(部分人工智能研究中心计算机视觉组) Department of Computer Engineering, Amirkabir University of Technology(阿米卡比尔技术大学计算机工程系)

专题命中 个性化与一致性 :diffusion(title,abstract);image generation(title);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.05659 2025-09-09 cs.CV 88%

EditIDv2: Editable ID Customization with Data-Lubricated ID Feature Integration for Text-to-Image Generation

Guandong Li, Zhaobin Chu

机构 * iFlyTek(科大讯飞)

专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(title);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02107 2025-08-05 cs.CV 88%

AutoLoRA: Automatic LoRA Retrieval and Fine-Grained Gated Fusion for Text-to-Image Generation

Zhiwen Li, Zhongjie Duan, Die Chen, Cen Chen, Daoyuan Chen, Yaliang Li, Yingda Chen

专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(title);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.17502 2025-05-30 cs.CV 88%

RefVNLI: Towards Scalable Evaluation of Subject-driven Text-to-image Generation

Aviv Slobodkin, Hagai Taitelbaum, Yonatan Bitton, Brian Gordon, Michal Sokolik, Nitzan Bitton Guetta, Almog Gueta, Royi Rassin, Dani Lischinski, Idan Szpektor

机构 * Google Research(谷歌研究) Ben Gurion University(本· Gurion大学)

专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.18790 2024-09-13 cs.CV cs.AI 88%

MUMU: Bootstrapping Multimodal Image Generation from Text-to-Image Data

William Berman, Alexander Peysakhovich

专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(title);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.16766 2024-09-05 cs.CV 88%

CSGO: Content-Style Composition in Text-to-Image Generation

Peng Xing, Haofan Wang, Yanpeng Sun, Qixun Wang, Xu Bai, Hao Ai, Renyuan Huang, Zechao Li

专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(title);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.11236 2024-06-14 cs.CV 88%

TriLoRA: Integrating SVD for Advanced Style Personalization in Text-to-Image Generation

Chengcheng Feng, Mu He, Qiuyu Tian, Haojie Yin, Xiaofang Zhao, Hongwei Tang, Xingqiang Wei

专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(title);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.05000 2024-06-10 cs.CV 88%

AttnDreamBooth: Towards Text-Aligned Personalized Text-to-Image Generation

Lianyu Pang, Jian Yin, Baoquan Zhao, Feize Wu, Fu Lee Wang, Qing Li, Xudong Mao

专题命中 个性化与一致性 :text-to-image(title,abstract);image generation(title);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.12978 2024-05-22 cs.CV 88%

Personalized Residuals for Concept-Driven Text-to-Image Generation

Cusuh Ham, Matthew Fisher, James Hays, Nicholas Kolkin, Yuchen Liu, Richard Zhang, Tobias Hinz

专题命中 个性化与一致性 :text-to-image(title,abstract);image generation(title);diffusion(abstract);分类 cs.CV

Comments CVPR 2024. Project page at https://cusuh.github.io/personalized-residuals

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.08799 2024-04-16 cs.CV cs.AI cs.HC cs.LG 88%

Semantic Approach to Quantifying the Consistency of Diffusion Model Image Generation

Brinnae Bent

专题命中 个性化与一致性 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

Comments Accepted to 2024 CVPR 3rd Explainable AI for Computer Vision (XAI4CV) Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.02733 2024-04-08 cs.CV 88%

InstantStyle: Free Lunch towards Style-Preserving in Text-to-Image Generation

Haofan Wang, Matteo Spinelli, Qixun Wang, Xu Bai, Zekui Qin, Anthony Chen

专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(title);diffusion(abstract);分类 cs.CV

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏