Block-wise LoRA: Revisiting Fine-grained LoRA for Effective Personalization and Stylization in Text-to-Image Generation
专题命中 个性化与一致性 :text-to-image(title,abstract);image generation(title);diffusion(abstract);分类 cs.CV
视觉与机器人
图像生成、文生图、图像编辑、扩散模型和可控生成。
专题命中 个性化与一致性 :text-to-image(title,abstract);image generation(title);diffusion(abstract);分类 cs.CV
专题命中 个性化与一致性 :diffusion(title,abstract);image generation(title);text-to-image(abstract);分类 cs.CV
专题命中 个性化与一致性 :text-to-image(title,abstract);image synthesis(title);diffusion(abstract);分类 cs.CV
Comments Accepted to ICCV 2023. Project page: https://anti-dreambooth.github.io/
专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(title,abstract);分类 cs.CV
Comments Accepted at NeurIPS 2023. Model Service to be appear as Google Vertex AI - Instant Tuning (https://cloud.google.com/vertex-ai/docs/generative-ai/image/fine-tune-model). The link to demo video: https://www.youtube.com/watch?v=Q2xQ91D_dhM&t=2071s&ab_channel=GoogleCloud
专题命中 个性化与一致性 :text-to-image(title,abstract);image generation(title);diffusion(abstract);分类 cs.CV
Comments Preprint. Project page at https://styledrop.github.io
专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(title,abstract);分类 cs.CV
Comments 13 pages
LoRA-Key:面向用户的文本到图像扩散模型LoRA水印
专题命中 个性化与一致性 :text-to-image(title,abstract);diffusion(title,abstract)
AI总结 提出LoRA-Key框架,通过可重用的用户特定水印LoRA实现版权保护,无需重新训练或修改目标LoRA。
专题命中 个性化与一致性 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);personalized generation(abstract)
Comments 14 pages, 16 figures
DSH-Bench: 一个具有层次化主体分类的难度和场景感知基准,用于主体驱动的文本到图像生成
机构 * Tencent(腾讯)
专题命中 个性化与一致性 :text-to-image(title,abstract);image generation(title);分类 cs.CV
AI总结 DSH-Bench通过四个创新解决现有基准的不足,提供层次化主体分类和细粒度评估,引入SICS指标提升主体保持度评估,并通过实验证明其在模型优化中的指导作用。
针对个性化文本到图像合成的跨图像一致性约束隐私保护
机构 * Beihang University(北京航空航天大学) ; Huazhong University of Science and Technology(华中科技大学) ; East China Normal University(东华大学)
专题命中 个性化与一致性 :text-to-image(title);image synthesis(title);diffusion(abstract);分类 cs.CV
AI总结 提出跨图像反个性化框架,通过强制扰动图像间的风格一致性并采用动态比率调整策略,增强对扩散模型个性化攻击的抵抗能力。
FreeGraftor:无需训练的跨图像特征移植用于主体驱动的文本到图像生成
机构 * College of Artificial Intelligence, Beijing University of Posts and Telecommunications(北京邮电大学人工智能学院) ; Li Auto Inc.(理想汽车)
专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(title);分类 cs.CV
AI总结 本文提出FreeGraftor,通过跨图像特征移植解决主体驱动图像生成中保真度与效率的平衡问题,采用语义匹配和位置约束注意力融合,结合新的噪声初始化策略,实现高保真主体身份迁移和文本对齐的场景合成。
Comments Code: https://github.com/Nihukat/FreeGraftor
专题命中 个性化与一致性 :text-to-image(title,abstract);image generation(title);分类 cs.CV
专题命中 个性化与一致性 :text-to-image(title,abstract);image generation(title);分类 cs.CV
Comments NeurIPS 2024
专题命中 个性化与一致性 :text-to-image(title,abstract);diffusion(title);分类 cs.CV
专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(title);分类 cs.CV
Comments 12 pages, 5 figures
专题命中 个性化与一致性 :image generation(title);text-to-image(title);diffusion(abstract);分类 cs.CV
Comments Technical Report
专题命中 个性化与一致性 :inpainting(title,abstract);diffusion(title);分类 cs.CV
代理调优:为以主题驱动的图像生成定制多模态自回归模型
机构 * University of Science and Technology of China(中国科学技术大学) ; The Chinese University of Hong Kong(香港中文大学) ; The University of Hong Kong(香港大学) ; Nanjing University of Information Science and Technology(南京信息工程大学)
专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV、cs.MM
AI总结 本文提出代理调优方法,通过扩散模型增强AR模型在主题驱动图像生成中的能力,揭示了弱到强泛化现象,提升了多主题组合和上下文理解的表现。
专题命中 个性化与一致性 :image generation(title);image editing(title);分类 cs.CV、cs.GR、cs.MM
Comments 2 pages, 2 figures. Accepted as Spotlight to NeurIPS 2023 Workshop on Machine Learning for Creativity and Design
LCG: 基于稀疏关系注意力的一致长上下文图像生成
机构 * Huazhong University of Science and Technology(华中科技大学) ; Peking University(北京大学) ; Hong Kong University of Science and Technology(香港科技大学)
专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(abstract);image synthesis(abstract);分类 cs.CV
AI总结 提出LCG框架,利用稀疏关系注意力(SRA)和路由一致性约束(RCC),在长序列图像生成中保持语义和外观一致性,并构建了大规模数据集LCCD进行训练和评估。
IDDM: 一种具有可调隐私-效用权衡的去标识化个性化扩散模型
机构 * The Hong Kong Polytechnic University(香港理工大学)
专题命中 个性化与一致性 :diffusion(title,abstract);text-to-image(abstract);personalized generation(abstract);分类 cs.CV
AI总结 本文提出IDDM模型,通过在个性化流程中集成身份解耦,实现授权个性化的同时降低公开生成的身份可链接性,可调隐私-效用权衡。
TaxaAdapter:视觉分类模型是生命树上细粒度图像生成的关键
机构 * Virginia Tech(弗吉尼亚理工大学) ; The Ohio State University(俄亥俄州立大学) ; MIT(麻省理工学院) ; Boston University(波士顿大学)
专题命中 个性化与一致性 :image generation(title);text-to-image(abstract);diffusion(abstract);image synthesis(abstract)
AI总结 本文提出TaxaAdapter,通过整合视觉分类模型提升细粒度物种生成的精度与一致性,实验表明其在形态学和物种识别准确性上优于现有方法,且具备良好的泛化能力。
在需要的地方注入:无需训练的空间自适应身份保持用于文本到图像个性化
机构 * iFLYTEK ; Aegon THTF
专题命中 个性化与一致性 :text-to-image(title,abstract);image generation(abstract);diffusion(abstract);分类 cs.CV
AI总结 SpatialID通过无需训练的空间自适应方法,有效提升文本到图像个性化中的身份保持与文本一致性。
DreamVAR: 镇压强化视觉自回归模型以实现高保真主体驱动图像生成
机构 * Nanjing University of Science and Technology(南京理工大学) ; University of Science and Technology of China(中国科学技术大学) ; HiDream.ai Inc.(HiDream.ai公司)
专题命中 个性化与一致性 :image generation(title,abstract);diffusion(abstract);image synthesis(abstract);分类 cs.CV
AI总结 DreamVAR通过改进的自回归模型和强化学习,实现高保真主体驱动图像生成,优于现有扩散方法。
Comments Accepted By ICASSP 2026
OpenSubject: 利用视频衍生的身份和多样性先验进行主体驱动的图像生成与操纵
机构 * HKUST(香港科技大学) ; Meituan(美团) ; HKUST(GZ)(香港科技大学(广州))
专题命中 个性化与一致性 :image generation(title,abstract);inpainting(abstract);image synthesis(abstract);分类 cs.CV
AI总结 OpenSubject通过视频衍生的大规模数据集提升主体驱动图像生成与操纵的性能,尤其在复杂场景中表现更优。
一种风格等同于一个代码:通过离散风格空间解锁代码到风格图像生成
机构 * Beihang University(北航大学) ; Kolors Team, Kuaishou Technology(快手科技色彩团队) ; South China Normal University(华南师范大学)
专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV
AI总结 本文提出CoTyle,通过离散风格空间实现代码到风格图像生成,以数值代码控制图像风格,提升生成效率与多样性。
Comments Code: https://github.com/Kwai-Kolors/CoTyle Demo: https://huggingface.co/spaces/Kwai-Kolors/CoTyle Homepage: https://kwai-kolors.github.io/CoTyle/
扩散模型在个性化内容合成中的综述
机构 * Department of Computing(计算系) ; The Hong Kong Polytechnic University(香港理工大学) ; Center for Artificial Intelligence and Robotics(人工智能与机器人中心) ; Hong Kong Institute of Science & Innovation(香港科学创新研究院) ; Chinese Academy of Sciences(中国科学院) ; State Key Laboratory of Multimodal Artificial Intelligence Systems(多模态人工智能系统国家重点实验室) ; Chinese Academy of Sciences Institute of Automation(中国科学院自动化研究所) ; School of Artificial Intelligence(人工智能学院) ; University of Chinese Academy of Sciences(中国科学院大学)
专题命中 个性化与一致性 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV
AI总结 本文综述了扩散模型在个性化内容合成中的应用,分析了测试时微调和预训练适应方法,探讨了个性化任务的挑战与创新,并提出了未来发展方向。
Journal ref Machine intelligence research, Oct. 2025, v. 22, no. 5, p. 817-848
无训练的风格对齐图像生成方法:基于尺度的自回归模型
机构 * DGIST, Daegu, Republic of Korea(韩国大邱科学技术院) ; KETI, Republic of Korea(韩国科技信息院)
专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV
AI总结 本文提出一种无训练的风格对齐图像生成方法,通过基于尺度的自回归模型提升生成质量与推理速度,实现风格一致性与高效生成。
Comments 18 pages, 15 figures
机构 * ByteDance FanQie(字节跳动FanQie)
专题命中 个性化与一致性 :image generation(title,abstract);image synthesis(abstract);personalized generation(abstract);分类 cs.CV
机构 * Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(深圳先进技术研究所,中国科学院) ; Northeastern University(东北大学) ; Shenzhen University of Advanced Technology(深圳先进技术大学)
专题命中 个性化与一致性 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV