arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 1266 信号源:cs.CV, cs.GR, cs.MM

1. 个性化与一致性 1266 篇

2507.07056 2026-06-30 cs.CR cs.LG 75%

LoRAShield: Data-Free Editing Alignment for Secure Personalized LoRA Sharing

LoRAShield: 无数据编辑对齐用于安全的个性化LoRA分享

Jiahao Chen, Junhao Li, Yiming Wang, Yong Yang, Yi Jiang, Chunyi Zhou, Qingming Li, Tianyu Du, Shouling Ji

机构 * Zhejiang University(浙江大学) Guizhou Medical University(贵州医科大学)

专题命中 个性化与一致性 :image generation(abstract);text-to-image(abstract);diffusion(abstract)

AI总结 LoRAShield通过对抗优化和语义增强动态编辑和对齐LoRA权重子空间,有效阻止恶意生成,保障个性化模型的安全共享。

Comments Accepted by SIGKDD 2026 Cycle2

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26111 2026-05-26 cs.CV cs.AI cs.GR cs.LG cs.MM 75%

Squeezing Capacity from Multimodal Large Language Models for Subject-driven Generation

从多模态大语言模型中榨取能力用于主题驱动生成

Shuhong Zheng, Aashish Kumar Misraa, Yu-Teng Li, Yu-Jhe Li, Igor Gilitschenski

机构 * University of Toronto & Vector Institute(多伦多大学及向量研究所) Adobe(Adobe公司) Google(谷歌公司)

专题命中 个性化与一致性 :image generation(abstract);diffusion(abstract);分类 cs.CV、cs.GR、cs.MM

AI总结 提出一种结合多模态大语言模型和VAE身份条件的方法,通过双层级聚合模块和多阶段去噪策略,在主题驱动图像生成中实现多模态理解与身份保持的平衡,优于现有方法。

Comments 33 pages, 18 figures, Project Page: https://zsh2000.github.io/squeeze-mllm-subject-gen/

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22743 2026-05-22 cs.LG 75%

SeqLoRA: Bilevel Orthogonal Adaptation for Continual Multi-Concept Generation

SeqLoRA: 为持续多概念生成的双水平正则化适应

Javad Parsa, Enis Simsar, Amir Joudaki, Thomas Hofmann, André M. H. Teixeira

机构 * Uppsala University(乌普萨拉大学) ETH Zurich(苏黎世联邦理工学院) Sweden(瑞典)

专题命中 个性化与一致性 :image generation(abstract);text-to-image(abstract);diffusion(abstract)

AI总结 本文提出SeqLoRA,一种双水平优化框架,通过联合优化LoRA因素来解决文本到图像扩散模型中多自定义概念组合时的表示干扰问题,提高了身份保持性和可扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11585 2025-12-30 cs.LG cs.DC 75%

Parameter-Efficient and Personalized Federated Training of Generative Models at the Edge

边缘设备上的参数高效和个性化生成模型联邦训练

Kabir Khan, Manju Sarkar, Anita Kar, Suresh Ghosh

机构 * Department of Computer Science, San Francisco State University(计算机科学系,圣弗朗西斯科州立大学) Department of Communication Systems, University of Lakhimpur(通信系统系,拉贾斯坦邦大学) Department of Embedded Systems, Manipur University(嵌入式系统系,曼尼普尔大学) Department of Chemical Engineering, Lakshadweep University(化学工程系,拉克沙德韦普大学)

专题命中 个性化与一致性 :image generation(abstract);diffusion(abstract);image synthesis(abstract)

AI总结 FedGen-Edge通过解耦预训练骨干和轻量级适配器,在边缘设备上实现参数高效和个性化生成模型的联邦训练,降低通信开销并提升收敛速度。

Comments 37 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10135 2025-11-24 cs.AI 75%

CharCom: Composable Identity Control for Multi-Character Story Illustration

CharCom:多角色故事插图的可组合身份控制

Zhongsheng Wang, Ming Lin, Zhedong Lin, Yaser Shakib, Qian Liu, Jiamou Liu

机构 * Wuhan University of Communication(武汉通信大学) University of Auckland(奥克兰大学)

专题命中 个性化与一致性 :image generation(abstract);text-to-image(abstract);diffusion(abstract)

AI总结 CharCom通过可组合的LoRA适配器实现多角色故事插图中的角色一致性,提高了保真度和语义对齐,适用于动画和故事插图等实际应用。

Comments Accepted by ACM MMAsia 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.11909 2025-03-04 cs.LG cs.AI 75%

Mixture-of-Subspaces in Low-Rank Adaptation

Taiqiang Wu, Jiahao Wang, Zhe Zhao, Ngai Wong

专题命中 个性化与一致性 :image generation(abstract);text-to-image(abstract);diffusion(abstract)

Comments EMNLP 2024 Main, Oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.19456 2024-04-02 cs.CV cs.GR cs.MM 75%

Break-for-Make: Modular Low-Rank Adaptations for Composable Content-Style Customization

Yu Xu, Fan Tang, Juan Cao, Yuxin Zhang, Oliver Deussen, Weiming Dong, Jintao Li, Tong-Yee Lee

专题命中 个性化与一致性 :text-to-image(abstract);personalized generation(abstract);分类 cs.CV、cs.GR、cs.MM

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07713 2026-08-11 cs.CV cs.LG 新提交 74%

Tokenizer Generator Coupling in Medical Image Generation

医疗图像生成中的分词器-生成器耦合

Liam Chalcroft

机构 * University College London(伦敦大学学院)

专题命中 个性化与一致性 :image generation(title);分类 cs.CV

AI总结 该研究针对64×64低分辨率医疗图像,发现分词器与生成器的分离不合理,提出邻域条件预测增益指标,调优D3PM和SE-D3PM后FID-192大幅下降,验证了分词器-生成器耦合的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20090 2026-05-20 cs.CV 74%

MetaEarth-MM: Unified Multimodal Remote Sensing Image Generation with Scene-centered Joint Modeling

MetaEarth-MM:基于场景中心联合建模的多模态遥感图像生成

Zhiping Yu, Chenyang Liu, Jinqi Cao, Qinzhe Yang, Siwei Yu, Zhengxia Zou, Zhenwei Shi

机构 * Department of Aerospace Intelligent Science and Technology, School of Astronautics, Beihang University(航天智能科学与技术系,航天学院,北京航空航天大学) State Key Laboratory of Virtual Reality Technology and Systems, Beihang University(虚拟现实技术与系统国家重点实验室,北京航空航天大学) Shenyuan Honors College, Beihang University(Shen Yuan荣誉学院,北京航空航天大学)

专题命中 个性化与一致性 :image generation(title);分类 cs.CV

AI总结 本文提出MetaEarth-MM模型,通过统一的多模态遥感图像生成框架,实现多模态图像的联合生成和任意模态之间的转换,展示了其在多模态遥感观测中的强大生成能力和广泛适用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05183 2026-04-08 cs.CV cs.AI cs.LG 74%

OrthoFuse: Training-free Riemannian Fusion of Orthogonal Style-Concept Adapters for Diffusion Models

OrthoFuse:无训练的正交风格-概念适配器的黎曼融合

Ali Aliev, Kamil Garifullin, Nikolay Yudin, Vera Soboleva, Alexander Molozhavenko, Ivan Oseledets, Aibek Alanov, Maxim Rakhuba

机构 * HSE University(高等经济大学) FusionBrain Lab(FusionBrain实验室) AXXX

专题命中 个性化与一致性 :diffusion(title);分类 cs.CV

AI总结 本文提出无训练的正交适配器融合方法,通过几何性质和谱恢复变换实现多任务适配器的高效融合,适用于生成模型的主体驱动生成任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07540 2026-03-10 cs.CV cs.AI 74%

How Long Can Unified Multimodal Models Generate Images Reliably? Taming Long-Horizon Interleaved Image Generation via Context Curation

统一多模态模型能可靠生成图像多长?通过上下文筛选驯服长周期交错图像生成

Haoyu Chen, Qing Liu, Yuqian Zhou, He Zhang, Zhaowen Wang, Mengwei Ren, Jingjing Ren, Xiang Wang, Zhe Lin, Lei Zhu

机构 * The Hong Kong University of Science(香港科学与技术大学) Adobe Research(Adobe研究) Huazhong University of Science(华中科技大学)

专题命中 个性化与一致性 :image generation(title);分类 cs.CV

AI总结 本研究提出UniLongGen,通过动态筛选模型记忆以提升长周期图像生成的稳定性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04515 2025-12-05 cs.CV 74%

EgoLCD: Egocentric Video Generation with Long Context Diffusion

EgoLCD:基于长上下文扩散的自体视频生成

Liuzhou Zhang, Jiarui Ye, Yuanlei Wang, Ming Zhong, Mingju Cao, Wanke Xia, Bowen Zeng, Zeyu Zhang, Hao Tang

机构 * Peking University(北京大学) Sun Yat-sen University(中山大学) Zhejiang University(浙江大学) Chinese Academy of Sciences(中国科学院) Tsinghua University(清华大学)

专题命中 个性化与一致性 :diffusion(title);分类 cs.CV

AI总结 EgoLCD通过结合长时稀疏KV缓存和LoRA扩展的注意力机制,实现了高效稳定的自体长上下文视频生成,提升了感知质量和时间一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08220 2025-08-12 cs.CV 74%

Learning User Preferences for Image Generation Model

Wenyi Mo, Ying Ba, Tianyu Zhang, Yalong Bai, Biye Li

专题命中 个性化与一致性 :image generation(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.19557 2025-07-22 cs.CV 74%

Dance Like a Chicken: Low-Rank Stylization for Human Motion Diffusion

Haim Sawdayee, Chuan Guo, Guy Tevet, Bing Zhou, Jian Wang, Amit H. Bermano

机构 * Tel Aviv University(特拉维夫大学) Snap Inc.(Snap公司)

专题命中 个性化与一致性 :diffusion(title);分类 cs.CV

Comments Project page at MDM/" target="_blank" rel="noopener">https://haimsaw.github.io/LoRA-MDM/

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12517 2025-06-17 cs.CV 74%

Retrieval Augmented Comic Image Generation

Yunhao Shui, Xuekuan Wang, Feng Qiu, Yuqiu Huang, Jinzhu Li, Haoyu Zheng, Jinru Han, Zhuo Zeng, Pengpeng Zhang, Jiarui Han, Keqiang Sun

机构 * Zulution AI

专题命中 个性化与一致性 :image generation(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09916 2025-06-12 cs.CV 74%

Only-Style: Stylistic Consistency in Image Generation without Content Leakage

Tilemachos Aravanis, Panagiotis Filntisis, Petros Maragos, George Retsinas

机构 * School of Electrical & Computer Engineering, National Technical University of Athens(电气与计算机工程学院,国家技术大学雅典分校) Robotics Institute, Athena Research Center(机器人研究所,雅典研究中心) HERON - Center of Excellence in Robotics(HERON-机器人卓越中心)

专题命中 个性化与一致性 :image generation(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18106 2025-05-26 cs.CV cond-mat.mtrl-sci cs.LG eess.IV 74%

F-ANcGAN: An Attention-Enhanced Cycle Consistent Generative Adversarial Architecture for Synthetic Image Generation of Nanoparticles

Varun Ajith, Anindya Pal, Saumik Bhattacharya, Sayantari Ghosh

专题命中 个性化与一致性 :image generation(title);分类 cs.CV

Comments 11 pages, 9 figures, 2 tables, conference paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11143 2025-03-17 cs.CV 74%

GaussianIP: Identity-Preserving Realistic 3D Human Generation via Human-Centric Diffusion Prior

Zichen Tang, Yuan Yao, Miaomiao Cui, Liefeng Bo, Hongyu Yang

专题命中 个性化与一致性 :diffusion(title);分类 cs.CV

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.14162 2025-02-25 cs.CV 74%

OrthoGAN:High-Precision Image Generation for Teeth Orthodontic Visualization

Feihong Shen, JIngjing Liu, Jianwen Lou, Haizhen Li, Bing Fang, Chenglong Ma, Jin Hao, Yang Feng, Youyi Zheng

专题命中 个性化与一致性 :image generation(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.11638 2025-02-05 cs.CV 74%

IDProtector: An Adversarial Noise Encoder to Protect Against ID-Preserving Image Generation

Yiren Song, Pei Yang, Hai Ci, Mike Zheng Shou

专题命中 个性化与一致性 :image generation(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.05724 2024-12-10 cs.CV cs.AI 74%

A Tiered GAN Approach for Monet-Style Image Generation

FNU Neha, Deepshikha Bhati, Deepak Kumar Shukla, Md Amiruzzaman

专题命中 个性化与一致性 :image generation(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.11627 2024-07-12 cs.CV 74%

LoRA-Composer: Leveraging Low-Rank Adaptation for Multi-Concept Customization in Training-Free Diffusion Models

Yang Yang, Wen Wang, Liang Peng, Chaotian Song, Yao Chen, Hengjia Li, Xiaolong Yang, Qinglin Lu, Deng Cai, Boxi Wu, Wei Liu

专题命中 个性化与一致性 :diffusion(title);分类 cs.CV

Comments project page: https://github.com/Young98CN/LoRA_Composer

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.00460 2024-01-02 cs.CV 74%

RainSD: Rain Style Diversification Module for Image Synthesis Enhancement using Feature-Level Style Distribution

Hyeonjae Jeon, Junghyun Seo, Taesoo Kim, Sungho Son, Jungki Lee, Gyeungho Choi, Yongseob Lim

专题命中 个性化与一致性 :image synthesis(title);分类 cs.CV

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.18169 2023-12-01 cs.CV 74%

Few-shot Image Generation via Style Adaptation and Content Preservation

Xiaosheng He, Fan Yang, Fayao Liu, Guosheng Lin

专题命中 个性化与一致性 :image generation(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.16275 2023-08-01 cs.CV 74%

Stylized Projected GAN: A Novel Architecture for Fast and Realistic Image Generation

Md Nurul Muttakin, Malik Shahid Sultan, Robert Hoehndorf, Hernando Ombao

专题命中 个性化与一致性 :image generation(title);分类 cs.CV

Comments We present a new architecture for generating realistic images by combining mapping network of Style GANs and Projected GANs

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.04957 2023-06-09 cs.CV 74%

IFaceUV: Intuitive Motion Facial Image Generation by Identity Preservation via UV map

Hansol Lee, Yunhoe Ku, Eunseo Kim, Seungryul Baek

专题命中 个性化与一致性 :image generation(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.10278 2023-04-21 cs.CV 74%

Not Only Generative Art: Stable Diffusion for Content-Style Disentanglement in Art Analysis

Yankun Wu, Yuta Nakashima, Noa Garcia

专题命中 个性化与一致性 :diffusion(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.01172 2023-04-04 cs.CV 74%

Generative Multiplane Neural Radiance for 3D-Aware Image Generation

Amandeep Kumar, Ankan Kumar Bhunia, Sanath Narayan, Hisham Cholakkal, Rao Muhammad Anwer, Salman Khan, Ming-Hsuan Yang, Fahad Shahbaz Khan

专题命中 个性化与一致性 :image generation(title);分类 cs.CV

Comments Technical report

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.04844 2022-12-12 cs.CV cs.AI cs.LG eess.IV 74%

Album cover art image generation with Generative Adversarial Networks

Felipe Perez Stoppa, Ester Vidaña-Vila, Joan Navarro

专题命中 个性化与一致性 :image generation(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.00098 2022-11-02 cs.CV cs.CR 74%

Synthetic ID Card Image Generation for Improving Presentation Attack Detection

Daniel Benalcazar, Juan E. Tapia, Sebastian Gonzalez, Christoph Busch

专题命中 个性化与一致性 :image generation(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏