Emu Edit: Precise Image Editing via Recognition and Generation Tasks
专题命中 图像编辑 :image editing(title,abstract);inpainting(abstract);分类 cs.CV
视觉与机器人
图像生成、文生图、图像编辑、扩散模型和可控生成。
专题命中 图像编辑 :image editing(title,abstract);inpainting(abstract);分类 cs.CV
专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV
Comments 10 pages, 8 figures
专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV
专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV
Comments Accepted to BMVC 2023
专题命中 图像编辑 :image editing(title,abstract);image generation(abstract);分类 cs.CV
专题命中 图像编辑 :diffusion(title,abstract);image generation(abstract);分类 cs.CV
专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV
Comments Added inversion guidance, and fixed typos
专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV
Comments 8 pages, 5 figures, 1 table. This report builds up on the works introduced in - arXiv:2304.06140, arXiv:2301.12247
专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV
专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV
专题命中 图像编辑 :diffusion(title,abstract);image synthesis(abstract);分类 cs.CV
专题命中 图像编辑 :image generation(title,abstract);image editing(abstract);分类 cs.CV
Comments CVPR 2023. Project Page: https://rangwani-harsh.github.io/NoisyTwins/
专题命中 图像编辑 :diffusion(title,abstract);image editing(abstract);分类 cs.CV
专题命中 图像编辑 :image editing(title);image generation(abstract);text-to-image(abstract);分类 cs.CV
Comments 20 pages, 23 figures
专题命中 图像编辑 :image generation(title,abstract);image editing(abstract);分类 cs.CV
Comments CVPR 2022
专题命中 图像编辑 :diffusion(title,abstract);image generation(abstract);分类 cs.CV
Comments Accepted to CVPR 2022
专题命中 图像编辑 :image editing(title,abstract);inpainting(abstract);分类 cs.CV
专题命中 图像编辑 :image generation(title,abstract);diffusion(abstract);分类 cs.CV
专题命中 图像编辑 :image editing(title,abstract);image generation(abstract);分类 cs.CV
专题命中 图像编辑 :image generation(title,abstract);image editing(abstract);分类 cs.CV
Comments CVPR2022
专题命中 图像编辑 :image generation(title,abstract);image editing(abstract);分类 cs.CV
Comments ECCV 2020. Code: https://github.com/hytseng0509/ArtEditing
JoyAI-Image: 激活统一多模态理解和生成中的空间智能
机构 * Joy Future Academy, JD(京东探索研究院)
专题命中 图像编辑 :image generation(abstract);text-to-image(abstract);diffusion(abstract);image editing(abstract)
AI总结 本文提出JoyAI-Image,一种统一的多模态基础模型,用于视觉理解、文本到图像生成和指令引导的图像编辑。该模型结合了空间增强的多模态大语言模型(MLLM)和多模态扩散Transformer(MMDiT),通过共享的多模态接口实现感知与生成的交互。构建可扩展的训练配方,结合统一指令微调、长文本渲染监督、空间 grounded 数据和通用及空间编辑信号,使模型具备广泛的多模态能力,同时增强几何感知推理和可控视觉合成。实验表明,JoyAI-Image在理解、生成、长文本渲染和编辑基准上达到最先进的性能。更重要的是,增强的理解、可控的空间编辑和新视角辅助推理之间的双向循环使模型超越一般视觉能力,向更强的空间智能发展。
Comments Code: https://github.com/jd-opensource/JoyAI-Image
专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract)
机构 * Hong Kong University of Science and Technology(香港科学与技术大学) ; Alibaba Group(阿里巴巴集团)
专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract)
专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract)
专题命中 图像编辑 :image editing(title,abstract);inpainting(abstract)
Comments European Conference on Computer Vision (ECCV) 2024
专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract)
H-Adapter: 通过注意力导出的源对齐头发掩码实现姿态鲁棒的发型迁移
机构 * SNOW Corp.(SNOW公司)
专题命中 图像编辑 :image generation(abstract);text-to-image(abstract);diffusion(abstract);inpainting(abstract)
AI总结 提出H-Adapter,利用区域特定损失解耦头发与非头发目标,导出源对齐头发编辑掩码引导扩散修复,实现大姿态差异下的鲁棒发型迁移,在FID、FID_CLIP和CLIP-I指标上取得最优。
Comments Accepted at ECCV 2026. Project page: https://sanghunpark.github.io/hadapter_page/
专题命中 图像编辑 :text-to-image(abstract);diffusion(abstract);image editing(abstract);image synthesis(abstract)
Comments Accepted at CVPR 2024
专题命中 图像编辑 :image generation(abstract);diffusion(abstract);image editing(abstract);image synthesis(abstract)
Comments 6 pages,6 figures