arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 1263 信号源:cs.CV, cs.GR, cs.MM

1. 个性化与一致性 1263 篇

2403.07500 2024-03-13 cs.CV cs.AI 88%

Block-wise LoRA: Revisiting Fine-grained LoRA for Effective Personalization and Stylization in Text-to-Image Generation

Likun Li, Haoqi Zeng, Changpeng Yang, Haozhe Jia, Di Xu

专题命中 个性化与一致性 :text-to-image(title,abstract);image generation(title);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.17461 2023-11-30 cs.CV 88%

When StyleGAN Meets Stable Diffusion: a $\mathscr{W}_+$ Adapter for Personalized Image Generation

Xiaoming Li, Xinyu Hou, Chen Change Loy

专题命中 个性化与一致性 :diffusion(title,abstract);image generation(title);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.15433 2023-10-23 cs.CV cs.CR cs.LG 88%

Anti-DreamBooth: Protecting users from personalized text-to-image synthesis

Thanh Van Le, Hao Phung, Thuan Hoang Nguyen, Quan Dao, Ngoc Tran, Anh Tran

专题命中 个性化与一致性 :text-to-image(title,abstract);image synthesis(title);diffusion(abstract);分类 cs.CV

Comments Accepted to ICCV 2023. Project page: https://anti-dreambooth.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.00186 2023-10-03 cs.CV cs.AI 88%

Subject-driven Text-to-Image Generation via Apprenticeship Learning

Wenhu Chen, Hexiang Hu, Yandong Li, Nataniel Ruiz, Xuhui Jia, Ming-Wei Chang, William W. Cohen

专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(title,abstract);分类 cs.CV

Comments Accepted at NeurIPS 2023. Model Service to be appear as Google Vertex AI - Instant Tuning (https://cloud.google.com/vertex-ai/docs/generative-ai/image/fine-tune-model). The link to demo video: https://www.youtube.com/watch?v=Q2xQ91D_dhM&t=2071s&ab_channel=GoogleCloud

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.00983 2023-06-02 cs.CV cs.AI 88%

StyleDrop: Text-to-Image Generation in Any Style

Kihyuk Sohn, Nataniel Ruiz, Kimin Lee, Daniel Castro Chin, Irina Blok, Huiwen Chang, Jarred Barber, Lu Jiang, Glenn Entis, Yuanzhen Li, Yuan Hao, Irfan Essa, Michael Rubinstein, Dilip Krishnan

专题命中 个性化与一致性 :text-to-image(title,abstract);image generation(title);diffusion(abstract);分类 cs.CV

Comments Preprint. Project page at https://styledrop.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.03411 2023-04-10 cs.CV 88%

InstantBooth: Personalized Text-to-Image Generation without Test-Time Finetuning

Jing Shi, Wei Xiong, Zhe Lin, Hyun Joon Jung

专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(title,abstract);分类 cs.CV

Comments 13 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29569 2026-06-09 cs.CR 版本更新 88%

LoRA-Key: User-Centric LoRA Watermarking for Text-to-Image Diffusion Models

LoRA-Key:面向用户的文本到图像扩散模型LoRA水印

Yaopeng Wang, Qingliang Wang, Zhibo Wang, Huiyu Xu, Jiacheng Du, Qiu Wang, Jia-Li Yin, Kui Ren

专题命中 个性化与一致性 :text-to-image(title,abstract);diffusion(title,abstract)

AI总结 提出LoRA-Key框架,通过可重用的用户特定水印LoRA实现版权保护,无需重新训练或修改目标LoRA。

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.00631 2024-03-25 cs.CV 87%

Beyond Inserting: Learning Identity Embedding for Semantic-Fidelity Personalized Diffusion Generation

Yang Li, Songlin Yang, Wei Wang, Jing Dong

专题命中 个性化与一致性 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);personalized generation(abstract)

Comments 14 pages, 16 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08090 2026-07-01 cs.CV cs.AI 版本更新 86%

DSH-Bench: A Difficulty- and Scenario-Aware Benchmark with Hierarchical Subject Taxonomy for Subject-Driven Text-to-Image Generation

DSH-Bench: 一个具有层次化主体分类的难度和场景感知基准,用于主体驱动的文本到图像生成

Zhenyu Hu, Qing Wang, Te Cao, Luo Liao, Longfei Lu, Liqun Liu, Shuang Li, Hang Chen, Mengge Xue, Yuan Chen, Chao Deng, Peng Shu, Huan Yu, Jie Jiang

机构 * Tencent(腾讯)

专题命中 个性化与一致性 :text-to-image(title,abstract);image generation(title);分类 cs.CV

AI总结 DSH-Bench通过四个创新解决现有基准的不足,提供层次化主体分类和细粒度评估,引入SICS指标提升主体保持度评估,并通过实验证明其在模型优化中的指导作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12747 2026-05-29 cs.CV 86%

Privacy Protection Against Personalized Text-to-Image Synthesis via Cross-image Consistency Constraints

针对个性化文本到图像合成的跨图像一致性约束隐私保护

Guanyu Wang, Kailong Wang, Yihao Huang, Mingyi Zhou, Geguang Pu, Li Li

机构 * Beihang University(北京航空航天大学) Huazhong University of Science and Technology(华中科技大学) East China Normal University(东华大学)

专题命中 个性化与一致性 :text-to-image(title);image synthesis(title);diffusion(abstract);分类 cs.CV

AI总结 提出跨图像反个性化框架,通过强制扰动图像间的风格一致性并采用动态比率调整策略,增强对扩散模型个性化攻击的抵抗能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.15958 2026-04-07 cs.CV 86%

FreeGraftor: Training-Free Cross-Image Feature Grafting for Subject-Driven Text-to-Image Generation

FreeGraftor:无需训练的跨图像特征移植用于主体驱动的文本到图像生成

Zebin Yao, Lei Ren, Huixing Jiang, Wei Chen, Xiaojie Wang, Ruifan Li, Fangxiang Feng

机构 * College of Artificial Intelligence, Beijing University of Posts and Telecommunications(北京邮电大学人工智能学院) Li Auto Inc.(理想汽车)

专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(title);分类 cs.CV

AI总结 本文提出FreeGraftor,通过跨图像特征移植解决主体驱动图像生成中保真度与效率的平衡问题,采用语义匹配和位置约束注意力融合,结合新的噪声初始化策略,实现高保真主体身份迁移和文本对齐的场景合成。

Comments Code: https://github.com/Nihukat/FreeGraftor

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.08097 2025-02-13 cs.CV cs.CR 86%

ID-Cloak: Crafting Identity-Specific Cloaks Against Personalized Text-to-Image Generation

Qianrui Teng, Xing Cui, Xuannan Liu, Peipei Li, Zekun Li, Huaibo Huang, Ran He

专题命中 个性化与一致性 :text-to-image(title,abstract);image generation(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.12164 2024-12-24 cs.CV cs.AI cs.LG 86%

Subject-driven Text-to-Image Generation via Preference-based Reinforcement Learning

Yanting Miao, William Loh, Suraj Kothawade, Pascal Poupart, Abdullah Rashwan, Yeqing Li

专题命中 个性化与一致性 :text-to-image(title,abstract);image generation(title);分类 cs.CV

Comments NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.13833 2024-09-30 cs.CV cs.CL cs.LG 86%

Lego: Learning to Disentangle and Invert Personalized Concepts Beyond Object Appearance in Text-to-Image Diffusion Models

Saman Motamed, Danda Pani Paudel, Luc Van Gool

专题命中 个性化与一致性 :text-to-image(title,abstract);diffusion(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.12576 2024-09-20 cs.CV 86%

StoryMaker: Towards Holistic Consistent Characters in Text-to-image Generation

Zhengguang Zhou, Jing Li, Huaxia Li, Nemo Chen, Xu Tang

专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(title);分类 cs.CV

Comments 12 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.00788 2024-07-02 cs.CV 86%

InstantStyle-Plus: Style Transfer with Content-Preserving in Text-to-Image Generation

Haofan Wang, Peng Xing, Renyuan Huang, Hao Ai, Qixun Wang, Xu Bai

专题命中 个性化与一致性 :image generation(title);text-to-image(title);diffusion(abstract);分类 cs.CV

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.03771 2023-12-08 cs.CV 86%

DreamInpainter: Text-Guided Subject-Driven Image Inpainting with Diffusion Models

Shaoan Xie, Yang Zhao, Zhisheng Xiao, Kelvin C. K. Chan, Yandong Li, Yanwu Xu, Kun Zhang, Tingbo Hou

专题命中 个性化与一致性 :inpainting(title,abstract);diffusion(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10125 2025-12-02 cs.CV cs.MM 86%

Proxy-Tuning: Tailoring Multimodal Autoregressive Models for Subject-Driven Image Generation

代理调优:为以主题驱动的图像生成定制多模态自回归模型

Yi Wu, Shengju Qian, Lingting Zhu, Lei Liu, Wandi Qiao, Ziqiang Li, Lequan Yu, Bin Li

机构 * University of Science and Technology of China(中国科学技术大学) The Chinese University of Hong Kong(香港中文大学) The University of Hong Kong(香港大学) Nanjing University of Information Science and Technology(南京信息工程大学)

专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV、cs.MM

AI总结 本文提出代理调优方法,通过扩散模型增强AR模型在主题驱动图像生成中的能力,揭示了弱到强泛化现象,提升了多主题组合和上下文理解的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.05448 2024-03-05 cs.CV cs.AI cs.GR cs.LG cs.MM 86%

Minecraft-ify: Minecraft Style Image Generation with Text-guided Image Editing for In-Game Application

Bumsoo Kim, Sanghyun Byun, Yonghoon Jung, Wonseop Shin, Sareer UI Amin, Sanghyun Seo

专题命中 个性化与一致性 :image generation(title);image editing(title);分类 cs.CV、cs.GR、cs.MM

Comments 2 pages, 2 figures. Accepted as Spotlight to NeurIPS 2023 Workshop on Machine Learning for Creativity and Design

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26171 2026-06-26 cs.CV cs.AI 新提交 85%

LCG: Long-Context Consistent Image Generation with Sparse Relational Attention

LCG: 基于稀疏关系注意力的一致长上下文图像生成

Zihao Wang, Yijia Xu, Haoze Zheng, Xuran Ma, Haokun Gui, Harry Yang

机构 * Huazhong University of Science and Technology(华中科技大学) Peking University(北京大学) Hong Kong University of Science and Technology(香港科技大学)

专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(abstract);image synthesis(abstract);分类 cs.CV

AI总结 提出LCG框架,利用稀疏关系注意力(SRA)和路由一致性约束(RCC),在长序列图像生成中保持语义和外观一致性,并构建了大规模数据集LCCD进行训练和评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00903 2026-06-09 cs.CV 版本更新 85%

IDDM: Identity-Decoupled Personalized Diffusion Models with a Tunable Privacy-Utility Trade-off

IDDM: 一种具有可调隐私-效用权衡的去标识化个性化扩散模型

Linyan Dai, Xinwei Zhang, Haoyang Li, Qingqing Ye, Haibo Hu

机构 * The Hong Kong Polytechnic University(香港理工大学)

专题命中 个性化与一致性 :diffusion(title,abstract);text-to-image(abstract);personalized generation(abstract);分类 cs.CV

AI总结 本文提出IDDM模型,通过在个性化流程中集成身份解耦,实现授权个性化的同时降低公开生成的身份可链接性,可调隐私-效用权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26128 2026-03-30 cs.CV 85%

TaxaAdapter: Vision Taxonomy Models are Key to Fine-grained Image Generation over the Tree of Life

TaxaAdapter:视觉分类模型是生命树上细粒度图像生成的关键

Mridul Khurana, Amin Karimi Monsefi, Justin Lee, Medha Sawhney, David Carlyn, Julia Chae, Jianyang Gu, Rajiv Ramnath, Sara Beery, Wei-Lun Chao, Anuj Karpatne, Cheng Zhang

机构 * Virginia Tech(弗吉尼亚理工大学) The Ohio State University(俄亥俄州立大学) MIT(麻省理工学院) Boston University(波士顿大学)

专题命中 个性化与一致性 :image generation(title);text-to-image(abstract);diffusion(abstract);image synthesis(abstract)

AI总结 本文提出TaxaAdapter,通过整合视觉分类模型提升细粒度物种生成的精度与一致性,实验表明其在形态学和物种识别准确性上优于现有方法,且具备良好的泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13994 2026-02-17 cs.CV 85%

Inject Where It Matters: Training-Free Spatially-Adaptive Identity Preservation for Text-to-Image Personalization

在需要的地方注入:无需训练的空间自适应身份保持用于文本到图像个性化

Guandong Li, Mengxia Ye

机构 * iFLYTEK Aegon THTF

专题命中 个性化与一致性 :text-to-image(title,abstract);image generation(abstract);diffusion(abstract);分类 cs.CV

AI总结 SpatialID通过无需训练的空间自适应方法,有效提升文本到图像个性化中的身份保持与文本一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22507 2026-02-02 cs.CV 85%

DreamVAR: Taming Reinforced Visual Autoregressive Model for High-Fidelity Subject-Driven Image Generation

DreamVAR: 镇压强化视觉自回归模型以实现高保真主体驱动图像生成

Xin Jiang, Jingwen Chen, Yehao Li, Yingwei Pan, Kezhou Chen, Zechao Li, Ting Yao, Tao Mei

机构 * Nanjing University of Science and Technology(南京理工大学) University of Science and Technology of China(中国科学技术大学) HiDream.ai Inc.(HiDream.ai公司)

专题命中 个性化与一致性 :image generation(title,abstract);diffusion(abstract);image synthesis(abstract);分类 cs.CV

AI总结 DreamVAR通过改进的自回归模型和强化学习,实现高保真主体驱动图像生成,优于现有扩散方法。

Comments Accepted By ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08294 2025-12-11 cs.CV 85%

OpenSubject: Leveraging Video-Derived Identity and Diversity Priors for Subject-driven Image Generation and Manipulation

OpenSubject: 利用视频衍生的身份和多样性先验进行主体驱动的图像生成与操纵

Yexin Liu, Manyuan Zhang, Yueze Wang, Hongyu Li, Dian Zheng, Weiming Zhang, Changsheng Lu, Xunliang Cai, Yan Feng, Peng Pei, Harry Yang

机构 * HKUST(香港科技大学) Meituan(美团) HKUST(GZ)(香港科技大学(广州))

专题命中 个性化与一致性 :image generation(title,abstract);inpainting(abstract);image synthesis(abstract);分类 cs.CV

AI总结 OpenSubject通过视频衍生的大规模数据集提升主体驱动图像生成与操纵的性能,尤其在复杂场景中表现更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10555 2025-12-01 cs.CV cs.AI 85%

A Style is Worth One Code: Unlocking Code-to-Style Image Generation with Discrete Style Space

一种风格等同于一个代码:通过离散风格空间解锁代码到风格图像生成

Huijie Liu, Shuhao Cui, Haoxiang Cao, Shuai Ma, Kai Wu, Guoliang Kang

机构 * Beihang University(北航大学) Kolors Team, Kuaishou Technology(快手科技色彩团队) South China Normal University(华南师范大学)

专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV

AI总结 本文提出CoTyle,通过离散风格空间实现代码到风格图像生成,以数值代码控制图像风格,提升生成效率与多样性。

Comments Code: https://github.com/Kwai-Kolors/CoTyle Demo: https://huggingface.co/spaces/Kwai-Kolors/CoTyle Homepage: https://kwai-kolors.github.io/CoTyle/

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.05538 2025-12-01 cs.CV 85%

A Survey on Personalized Content Synthesis with Diffusion Models

扩散模型在个性化内容合成中的综述

Xulu Zhang, Xiaoyong Wei, Wentao Hu, Jinlin Wu, Jiaxin Wu, Wengyu Zhang, Zhaoxiang Zhang, Zhen Lei, Qing Li

机构 * Department of Computing(计算系) The Hong Kong Polytechnic University(香港理工大学) Center for Artificial Intelligence and Robotics(人工智能与机器人中心) Hong Kong Institute of Science & Innovation(香港科学创新研究院) Chinese Academy of Sciences(中国科学院) State Key Laboratory of Multimodal Artificial Intelligence Systems(多模态人工智能系统国家重点实验室) Chinese Academy of Sciences Institute of Automation(中国科学院自动化研究所) School of Artificial Intelligence(人工智能学院) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 个性化与一致性 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

AI总结 本文综述了扩散模型在个性化内容合成中的应用,分析了测试时微调和预训练适应方法,探讨了个性化任务的挑战与创新,并提出了未来发展方向。

Journal ref Machine intelligence research, Oct. 2025, v. 22, no. 5, p. 817-848

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.06144 2025-11-25 cs.CV 85%

A Training-Free Style-aligned Image Generation with Scale-wise Autoregressive Model

无训练的风格对齐图像生成方法:基于尺度的自回归模型

Jihun Park, Jongmin Gim, Kyoungmin Lee, Minseok Oh, Minwoo Choi, Jaeyeul Kim, Woo Chool Park, Sunghoon Im

机构 * DGIST, Daegu, Republic of Korea(韩国大邱科学技术院) KETI, Republic of Korea(韩国科技信息院)

专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV

AI总结 本文提出一种无训练的风格对齐图像生成方法,通过基于尺度的自回归模型提升生成质量与推理速度,实现风格一致性与高效生成。

Comments 18 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01181 2025-09-03 cs.CV cs.AI 85%

FocusDPO: Dynamic Preference Optimization for Multi-Subject Personalized Image Generation via Adaptive Focus

Qiaoqiao Jin, Siming Fu, Dong She, Weinan Jia, Hualiang Wang, Mu Liu, Jidong Jiang

机构 * ByteDance FanQie(字节跳动FanQie)

专题命中 个性化与一致性 :image generation(title,abstract);image synthesis(abstract);personalized generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08812 2025-08-13 cs.CV 85%

TARA: Token-Aware LoRA for Composable Personalization in Diffusion Models

Yuqi Peng, Lingtao Zheng, Yufeng Yang, Yi Huang, Mingfu Yan, Jianzhuang Liu, Shifeng Chen

机构 * Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(深圳先进技术研究所,中国科学院) Northeastern University(东北大学) Shenzhen University of Advanced Technology(深圳先进技术大学)

专题命中 个性化与一致性 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏