JeDi: Joint-Image Diffusion Models for Finetuning-Free Personalized Text-to-Image Generation
专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV、cs.GR
Comments CVPR 24
视觉与机器人
图像生成、文生图、图像编辑、扩散模型和可控生成。
专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV、cs.GR
Comments CVPR 24
专题命中 个性化与一致性 :diffusion(title,abstract);image editing(title,abstract);text-to-image(title);image generation(abstract)
用于主题驱动的个性化文本到图像生成的阶段感知适应与分布校准
机构 * School of Computer Science, Guangdong University of Technology(广东工业大学计算机学院) ; School of Computer Science, Peking University(北京大学计算机学院) ; ManXis(未知)
专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(title,abstract);diffusion(abstract);personalized generation(abstract)
AI总结 研究主题驱动的个性化文本到图像生成问题,提出将其分解为训练端的 SPaRa 和推理端的 DCAL 两个互补组件的框架 SPaRa-DCAL,通过理论分析和实验表明该框架能提升相关指标,并指出应综合多方面评估个性化生成。
Comments 16 pages, 4 figures, 6 tables
基于LLM提示翻译和LoRA微调的韩语日记文本情感感知图像生成
机构 * KAIST(韩国科学技术院)
专题命中 个性化与一致性 :diffusion(summary_cn,abstract);image generation(title,abstract);text-to-image(abstract);分类 cs.CV
AI总结 提出一种情感感知文本到图像流水线,利用Qwen3-8B识别短日记中的隐含情感,并通过LoRA微调Stable Diffusion 3.5 Medium生成儿童手绘风格图像,同时探讨情感触发词的影响及CLIP Score作为评估指标的局限性。
Comments 4 pages, 4 figures, 2 tables, MITA 2026
Journal ref Proc. Int. Conf. Multimedia, Information Technology and its Applications (MITA), 2026
机构 * University of Science and Technology of China(中国科学技术大学) ; The University of Hong Kong(香港大学) ; The Chinese University of Hong Kong(香港中文大学)
专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(title,abstract);image editing(abstract);分类 cs.CV、cs.MM
用于高保真主体驱动文本到图像生成的耦合潜在噪声引导的循环内模型适配
机构 * Southern University of Science and Technology(南方科技大学) ; University of Science and Technology of China(中国科学技术大学) ; Pengcheng Lab(鹏城实验室)
专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(title,abstract);diffusion(abstract);分类 cs.CV
AI总结 本研究针对主体驱动文本到图像生成中参考图像变化时模型难适配且难保持主体身份的问题,提出IMA方法,通过耦合潜在噪声损失引导循环内模型适配,提升了生成性能。
FlexID: 无训练灵活身份注入 via 意图感知调制 for 文本到图像生成
机构 * iFLYTEK
专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(title,abstract);diffusion(abstract);分类 cs.CV
AI总结 FlexID通过意图感知调制实现无训练灵活身份注入,提升文本到图像生成中身份保真度与文本适应性的平衡。
机构 * Xinjiang Technical Institute of Physics & Chemistry(新疆物理化学技术研究所) ; University of Chinese Academy of Sciences(中国科学院大学) ; Xinjiang Laboratory of Minority Speech and Language Information Processing(新疆少数民族语言信息处理实验室)
专题命中 个性化与一致性 :image generation(title,abstract);diffusion(title,abstract);text-to-image(abstract);分类 cs.CV
机构 * Department of Artificial Intelligence, Korea University(人工智能系,韩国大学)
专题命中 个性化与一致性 :text-to-image(title,abstract);image generation(title);diffusion(abstract);personalized generation(abstract)
机构 * School of Cyber Science and Technology, Shenzhen Campus of Sun Yat-sen University(中山大学网络科学与技术学院深圳校区) ; Technische Universität München(慕尼黑技术大学)
专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(title,abstract);inpainting(abstract);分类 cs.CV
机构 * School of Software, Shandong University(软件学院,山东大学) ; Shandong Research Institute of Shandong University(山东大学山东研究院) ; Inspur Technology(Inspur技术公司)
专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(title,abstract);diffusion(abstract);分类 cs.CV
专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(title,abstract);diffusion(abstract);分类 cs.CV
Comments ECCV 2024. Our code can be found at https://github.com/csyxwei/MasterWeaver
专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(title,abstract);diffusion(abstract);分类 cs.CV
专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(title,abstract);diffusion(abstract);分类 cs.CV
专题命中 个性化与一致性 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV、cs.GR
Comments Codes and Supplementary Material: https://github.com/guoyww/AnimateDiff
专题命中 个性化与一致性 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV、cs.GR
Comments Published at CVPR 2023. Project page: https://dreambooth.github.io/
Premier: 基于可学习用户嵌入的个性化偏好调节在文本到图像生成中
机构 * Harbin Institute of Technology(哈尔滨工业大学) ; Duxiaoman(度小满)
专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(title,abstract);分类 cs.CV
AI总结 Premier通过可学习用户嵌入和偏好适配器实现个性化图像生成,引入分散损失提升用户偏好区分度,实验显示其在偏好对齐和文本一致性上表现更优。
文本到图像扩散模型中身份盆地的形态学分析
专题命中 个性化与一致性 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV
AI总结 通过形态学描述符和提示层面的音感结构,研究揭示了文本到图像扩散模型中身份盆地的系统性导航梯度,展示了身份稳定性和新视觉概念的生成。
Uni-Neur2Img:通过扩散变换器实现神经信号引导的图像生成、编辑和风格化
机构 * Fudan University(复旦大学) ; Zhejiang University(浙江大学) ; National University of Singapore(新加坡国立大学)
专题命中 个性化与一致性 :image generation(title,abstract);diffusion(title);image editing(abstract);分类 cs.CV
AI总结 Uni-Neur2Img通过扩散变换器实现神经信号引导的图像生成、编辑和风格化,提供统一且高效的解决方案。
机构 * Computer Vision Group, Part AI Research Center(部分人工智能研究中心计算机视觉组) ; Department of Computer Engineering, Amirkabir University of Technology(阿米卡比尔技术大学计算机工程系)
专题命中 个性化与一致性 :diffusion(title,abstract);image generation(title);image synthesis(abstract);分类 cs.CV
机构 * iFlyTek(科大讯飞)
专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(title);diffusion(abstract);分类 cs.CV
专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(title);diffusion(abstract);分类 cs.CV
机构 * Google Research(谷歌研究) ; Ben Gurion University(本· Gurion大学)
专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(title,abstract);分类 cs.CV
专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(title);diffusion(abstract);分类 cs.CV
专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(title);diffusion(abstract);分类 cs.CV
专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(title);diffusion(abstract);分类 cs.CV
专题命中 个性化与一致性 :text-to-image(title,abstract);image generation(title);image synthesis(abstract);分类 cs.CV
专题命中 个性化与一致性 :text-to-image(title,abstract);image generation(title);diffusion(abstract);分类 cs.CV
Comments CVPR 2024. Project page at https://cusuh.github.io/personalized-residuals
专题命中 个性化与一致性 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV
Comments Accepted to 2024 CVPR 3rd Explainable AI for Computer Vision (XAI4CV) Workshop
专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(title);diffusion(abstract);分类 cs.CV
Comments Technical Report