arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 4201 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 4201 篇

2312.02150 2024-04-04 cs.CV 83%

Readout Guidance: Learning Control from Diffusion Features

Grace Luo, Trevor Darrell, Oliver Wang, Dan B Goldman, Aleksander Holynski

专题命中 可控生成 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments CVPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.01852 2024-03-05 cs.CV 83%

PLACE: Adaptive Layout-Semantic Fusion for Semantic Image Synthesis

Zhengyao Lv, Yuxiang Wei, Wangmeng Zuo, Kwan-Yee K. Wong

专题命中 可控生成 :image synthesis(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.17910 2024-02-29 cs.CV 83%

Box It to Bind It: Unified Layout Control and Attribute Binding in T2I Diffusion Models

Ashkan Taghipour, Morteza Ghahremani, Mohammed Bennamoun, Aref Miri Rekavandi, Hamid Laga, Farid Boussaid

专题命中 可控生成 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.13404 2024-02-22 cs.CV 83%

Layout-to-Image Generation with Localized Descriptions using ControlNet with Cross-Attention Control

Denis Lukovnikov, Asja Fischer

专题命中 可控生成 :image generation(title);text-to-image(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.06446 2024-02-12 cs.CV 83%

ControlUDA: Controllable Diffusion-assisted Unsupervised Domain Adaptation for Cross-Weather Semantic Segmentation

Fengyi Shen, Li Zhou, Kagan Kucukaytekin, Ziyuan Liu, He Wang, Alois Knoll

专题命中 可控生成 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.03290 2024-02-06 cs.CV cs.AI cs.LG 83%

InstanceDiffusion: Instance-level Control for Image Generation

Xudong Wang, Trevor Darrell, Sai Saketh Rambhatla, Rohit Girdhar, Ishan Misra

专题命中 可控生成 :image generation(title);text-to-image(abstract);diffusion(abstract);分类 cs.CV

Comments Preprint; Project page: https://people.eecs.berkeley.edu/~xdwang/projects/InstDiff/

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.16762 2024-01-31 cs.CV 83%

Pick-and-Draw: Training-free Semantic Guidance for Text-to-Image Personalization

Henglei Lv, Jiayu Xiao, Liang Li, Qingming Huang

专题命中 可控生成 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.16157 2024-01-30 cs.CV cs.AI 83%

Spatial-Aware Latent Initialization for Controllable Image Generation

Wenqiang Sun, Teng Li, Zehong Lin, Jun Zhang

专题命中 可控生成 :image generation(title);text-to-image(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.03433 2024-01-09 cs.CV 83%

SpecRef: A Fast Training-free Baseline of Specific Reference-Condition Real Image Editing

Songyan Chen, Jiancheng Huang

专题命中 可控生成 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.10899 2023-12-19 cs.CV 83%

MagicScroll: Nontypical Aspect-Ratio Image Generation for Visual Storytelling via Multi-Layered Semantic-Aware Denoising

Bingyuan Wang, Hengyu Meng, Zeyu Cai, Lanjiong Li, Yue Ma, Qifeng Chen, Zeyu Wang

专题命中 可控生成 :image generation(title,abstract);diffusion(abstract);分类 cs.CV

Comments Project page: https://magicscroll.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.10135 2023-12-19 cs.CV 83%

Controllable Mind Visual Diffusion Model

Bohan Zeng, Shanglin Li, Xuhui Liu, Sicheng Gao, Xiaolong Jiang, Xu Tang, Yao Hu, Jianzhuang Liu, Baochang Zhang

专题命中 可控生成 :diffusion(title,abstract);image synthesis(abstract);分类 cs.CV

Comments 16 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.06971 2023-12-13 cs.CV 83%

CCM: Adding Conditional Controls to Text-to-Image Consistency Models

Jie Xiao, Kai Zhu, Han Zhang, Zhiheng Liu, Yujun Shen, Yu Liu, Xueyang Fu, Zheng-Jun Zha

专题命中 可控生成 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

Comments Project Page: https://swiftforce.github.io/CCM

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.14494 2023-11-29 cs.CV 83%

MVControl: Adding Conditional Control to Multi-view Diffusion for Controllable Text-to-3D Generation

Zhiqi Li, Yiming Chen, Lingzhe Zhao, Peidong Liu

专题命中 可控生成 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments Project page: https://lizhiqi49.github.io/MVControl/

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.02343 2023-11-07 cs.CV cs.AI 83%

Stable Diffusion Reference Only: Image Prompt and Blueprint Jointly Guided Multi-Condition Diffusion Model for Secondary Painting

Hao Ai, Lu Sheng

专题命中 可控生成 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2301.12247 2023-11-06 cs.CV cs.AI cs.LG 83%

SEGA: Instructing Text-to-Image Models using Semantic Guidance

Manuel Brack, Felix Friedrich, Dominik Hintersdorf, Lukas Struppek, Patrick Schramowski, Kristian Kersting

专题命中 可控生成 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

Comments arXiv admin note: text overlap with arXiv:2212.06013 Proceedings of the Advances in Neural Information Processing Systems: Annual Conference on Neural Information Processing Systems (NeurIPS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.00773 2023-10-12 cs.CV cs.AI 83%

DifFSS: Diffusion Model for Few-Shot Semantic Segmentation

Weimin Tan, Siyuan Chen, Bo Yan

专题命中 可控生成 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments code is available at https://github.com/TrinitialChan/DifFSS

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.14073 2023-08-04 cs.CV 83%

VideoControlNet: A Motion-Guided Video-to-Video Translation Framework by Using Diffusion Model with ControlNet

Zhihao Hu, Dong Xu

专题命中 可控生成 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.06458 2023-08-04 cs.CV 83%

HS-Diffusion: Semantic-Mixing Diffusion for Head Swapping

Qinghe Wang, Lijie Liu, Miao Hua, Pengfei Zhu, Wangmeng Zuo, Qinghua Hu, Huchuan Lu, Bing Cao

专题命中 可控生成 :diffusion(title,abstract);inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.12084 2023-07-25 cs.CV 83%

Edge Guided GANs with Multi-Scale Contrastive Learning for Semantic Image Synthesis

Hao Tang, Guolei Sun, Nicu Sebe, Luc Van Gool

专题命中 可控生成 :image synthesis(title,abstract);image generation(abstract);分类 cs.CV

Comments Accepted to TPAMI, an extended version of a paper published in ICLR2023. arXiv admin note: substantial text overlap with arXiv:2003.13898

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.09748 2023-04-20 cs.CV cs.AI 83%

Reference-based Image Composition with Sketch via Structure-aware Diffusion Model

Kangyeol Kim, Sunghyun Park, Junsoo Lee, Jaegul Choo

专题命中 可控生成 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments 7 pages; Code URL: https://github.com/kangyeolk/Paint-by-Sketch

详情

展开后加载摘要…

URL PDF HTML 收藏
2003.13898 2023-03-29 cs.CV cs.LG eess.IV 83%

Edge Guided GANs with Contrastive Learning for Semantic Image Synthesis

Hao Tang, Xiaojuan Qi, Guolei Sun, Dan Xu, Nicu Sebe, Radu Timofte, Luc Van Gool

专题命中 可控生成 :image synthesis(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
1911.00426 2022-10-11 cs.CV 83%

Cali-Sketch: Stroke Calibration and Completion for High-Quality Face Image Generation from Human-Like Sketches

Weihao Xia, Yujiu Yang, Jing-Hao Xue

专题命中 可控生成 :image generation(title,abstract);image synthesis(abstract);分类 cs.CV

Comments Accepted to Neurocomputing

Journal ref Volume 460, 14 October 2021, Pages 256-265

详情

展开后加载摘要…

URL PDF HTML 收藏
2209.02536 2022-09-07 cs.CV cs.AI 83%

Semantic Image Synthesis with Semantically Coupled VQ-Model

Stephan Alaniz, Thomas Hummel, Zeynep Akata

专题命中 可控生成 :image synthesis(title,abstract);image generation(abstract);分类 cs.CV

Comments ICLR 2022 DGM4HSD

详情

展开后加载摘要…

URL PDF HTML 收藏
2104.00567 2022-03-25 cs.CV cs.LG 83%

Text to Image Generation with Semantic-Spatial Aware GAN

Kai Hu, Wentong Liao, Michael Ying Yang, Bodo Rosenhahn

专题命中 可控生成 :image generation(title);text-to-image(abstract);image synthesis(abstract);分类 cs.CV

Comments arXiv admin note: text overlap with arXiv:1711.10485 by other authors

详情

展开后加载摘要…

URL PDF HTML 收藏
2112.00263 2021-12-02 cs.CV 83%

GLocal: Global Graph Reasoning and Local Structure Transfer for Person Image Generation

Liyuan Ma, Kejie Huang, Dongxu Wei, Haibin Shen

专题命中 可控生成 :image generation(title,abstract);inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2103.13722 2021-08-27 cs.CV 83%

AttrLostGAN: Attribute Controlled Image Synthesis from Reconfigurable Layout and Style

Stanislav Frolov, Avneesh Sharma, Jörn Hees, Tushar Karayil, Federico Raue, Andreas Dengel

专题命中 可控生成 :image synthesis(title,abstract);image generation(abstract);分类 cs.CV

Comments Accepted to GCPR 2021. Link to code: https://github.com/stanifrolov/AttrLostGAN

详情

展开后加载摘要…

URL PDF HTML 收藏
2004.11660 2020-09-07 cs.CV 83%

Disentangled and Controllable Face Image Generation via 3D Imitative-Contrastive Learning

Yu Deng, Jiaolong Yang, Dong Chen, Fang Wen, Xin Tong

专题命中 可控生成 :image generation(title,abstract);image synthesis(abstract);分类 cs.CV

Comments Accepted by CVPR2020 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2007.08397 2020-07-20 cs.CV cs.LG 83%

Controllable Image Synthesis via SegVAE

Yen-Chi Cheng, Hsin-Ying Lee, Min Sun, Ming-Hsuan Yang

专题命中 可控生成 :image synthesis(title);image generation(abstract);image editing(abstract);分类 cs.CV

Comments ECCV 2020. Project page: https://yccyenchicheng.github.io/SegVAE/ Code: https://github.com/yccyenchicheng/SegVAE

详情

展开后加载摘要…

URL PDF HTML 收藏
2002.07089 2020-05-21 eess.IV cs.CV cs.LG stat.ML 83%

4D Semantic Cardiac Magnetic Resonance Image Synthesis on XCAT Anatomical Model

Samaneh Abbasi-Sureshjani, Sina Amirrajab, Cristian Lorenz, Juergen Weese, Josien Pluim, Marcel Breeuwer

专题命中 可控生成 :image synthesis(title,abstract);image generation(abstract);分类 cs.CV

Comments Accepted to MIDL 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2004.03828 2020-04-09 cs.CV 83%

Attentive Normalization for Conditional Image Generation

Yi Wang, Ying-Cong Chen, Xiangyu Zhang, Jian Sun, Jiaya Jia

专题命中 可控生成 :image generation(title,abstract);inpainting(abstract);分类 cs.CV

Comments CVPR 2020

详情

展开后加载摘要…

URL PDF HTML 收藏