Focus on Your Instruction: Fine-grained and Multi-instruction Image Editing by Attention Modulation
专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV
Comments 14 pages, 9 figures
视觉与机器人
图像生成、文生图、图像编辑、扩散模型和可控生成。
专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV
Comments 14 pages, 9 figures
专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV
Comments Project page: https://yuzhou914.github.io/SmartEdit/
专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV
Comments Accepted by AAAI2024
专题命中 图像编辑 :image editing(title,abstract);inpainting(abstract);分类 cs.CV
专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV
Comments 10 pages, 8 figures
专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV
专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV
Comments Accepted to BMVC 2023
专题命中 图像编辑 :image editing(title,abstract);image generation(abstract);分类 cs.CV
专题命中 图像编辑 :diffusion(title,abstract);image generation(abstract);分类 cs.CV
专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV
Comments Added inversion guidance, and fixed typos
专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV
Comments 8 pages, 5 figures, 1 table. This report builds up on the works introduced in - arXiv:2304.06140, arXiv:2301.12247
专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV
专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV
专题命中 图像编辑 :diffusion(title,abstract);image synthesis(abstract);分类 cs.CV
专题命中 图像编辑 :image generation(title,abstract);image editing(abstract);分类 cs.CV
Comments CVPR 2023. Project Page: https://rangwani-harsh.github.io/NoisyTwins/
专题命中 图像编辑 :diffusion(title,abstract);image editing(abstract);分类 cs.CV
专题命中 图像编辑 :image editing(title);image generation(abstract);text-to-image(abstract);分类 cs.CV
Comments 20 pages, 23 figures
专题命中 图像编辑 :image generation(title,abstract);image editing(abstract);分类 cs.CV
Comments CVPR 2022
专题命中 图像编辑 :diffusion(title,abstract);image generation(abstract);分类 cs.CV
Comments Accepted to CVPR 2022
专题命中 图像编辑 :image editing(title,abstract);inpainting(abstract);分类 cs.CV
专题命中 图像编辑 :image generation(title,abstract);diffusion(abstract);分类 cs.CV
专题命中 图像编辑 :image editing(title,abstract);image generation(abstract);分类 cs.CV
专题命中 图像编辑 :image generation(title,abstract);image editing(abstract);分类 cs.CV
Comments CVPR2022
专题命中 图像编辑 :image generation(title,abstract);image editing(abstract);分类 cs.CV
Comments ECCV 2020. Code: https://github.com/hytseng0509/ArtEditing
JoyAI-Image: 激活统一多模态理解和生成中的空间智能
机构 * Joy Future Academy, JD(京东探索研究院)
专题命中 图像编辑 :image generation(abstract);text-to-image(abstract);diffusion(abstract);image editing(abstract)
AI总结 本文提出JoyAI-Image,一种统一的多模态基础模型,用于视觉理解、文本到图像生成和指令引导的图像编辑。该模型结合了空间增强的多模态大语言模型(MLLM)和多模态扩散Transformer(MMDiT),通过共享的多模态接口实现感知与生成的交互。构建可扩展的训练配方,结合统一指令微调、长文本渲染监督、空间 grounded 数据和通用及空间编辑信号,使模型具备广泛的多模态能力,同时增强几何感知推理和可控视觉合成。实验表明,JoyAI-Image在理解、生成、长文本渲染和编辑基准上达到最先进的性能。更重要的是,增强的理解、可控的空间编辑和新视角辅助推理之间的双向循环使模型超越一般视觉能力,向更强的空间智能发展。
Comments Code: https://github.com/jd-opensource/JoyAI-Image
DARS:用于基于指令的图像编辑的带结构化推理的双层级信用分配强化学习
机构 * South China Normal University(华南师范大学) ; KlingAI Research(可灵AI研究院)
专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract)
AI总结 提出DARS框架,解决基于指令的图像编辑系统仅用最终奖励训练效率低的问题,通过双层级信用分配实现更好性能,在推理密集型编辑上增益显著。
专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract)
机构 * Hong Kong University of Science and Technology(香港科学与技术大学) ; Alibaba Group(阿里巴巴集团)
专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract)
专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract)
专题命中 图像编辑 :image editing(title,abstract);inpainting(abstract)
Comments European Conference on Computer Vision (ECCV) 2024