arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 3480 信号源:cs.CV, cs.GR, cs.MM

1. 文生图 3480 篇

2312.06116 2023-12-12 cs.CV cs.AI cs.LG 83%

Stellar: Systematic Evaluation of Human-Centric Personalized Text-to-Image Methods

Panos Achlioptas, Alexandros Benetatos, Iordanis Fostiropoulos, Dimitris Skourtis

专题命中 文生图 :text-to-image(title,abstract);image generation(abstract);分类 cs.CV

Comments Preprint. Project page: https://stellar-gen-ai.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.07944 2023-11-16 cs.CV 83%

Text-to-Image Models for Counterfactual Explanations: a Black-Box Approach

Guillaume Jeanneret, Loïc Simon, Frédéric Jurie

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

Comments WACV 2024 Camera ready + supplementary material

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.00984 2023-10-27 cs.CV 83%

StableRep: Synthetic Images from Text-to-Image Models Make Strong Visual Representation Learners

Yonglong Tian, Lijie Fan, Phillip Isola, Huiwen Chang, Dilip Krishnan

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

Comments code is available at: https://github.com/google-research/syn-rep-learn

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.08094 2023-10-13 cs.CV 83%

SingleInsert: Inserting New Concepts from a Single Image into Text-to-Image Models for Flexible Editing

Zijie Wu, Chaohui Yu, Zhen Zhu, Fan Wang, Xiang Bai

专题命中 文生图 :text-to-image(title,abstract);image generation(abstract);分类 cs.CV

Comments Project page: https://jarrentwu1031.github.io/SingleInsert-web/

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.05590 2023-10-10 cs.CV 83%

Perceptual Artifacts Localization for Image Synthesis Tasks

Lingzhi Zhang, Zhengjie Xu, Connelly Barnes, Yuqian Zhou, Qing Liu, He Zhang, Sohrab Amirghodsi, Zhe Lin, Eli Shechtman, Jianbo Shi

专题命中 文生图 :image synthesis(title,abstract);inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.11989 2023-09-12 cs.CV 83%

Text2Room: Extracting Textured 3D Meshes from 2D Text-to-Image Models

Lukas Höllein, Ang Cao, Andrew Owens, Justin Johnson, Matthias Nießner

专题命中 文生图 :text-to-image(title,abstract);inpainting(abstract);分类 cs.CV

Comments Accepted to ICCV 2023 (Oral) video: https://youtu.be/fjRnFL91EZc project page: https://lukashoel.github.io/text-to-room/ code: https://github.com/lukasHoel/text2room

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.04399 2023-09-11 cs.CV 83%

MaskDiffusion: Boosting Text-to-Image Consistency with Conditional Mask

Yupeng Zhou, Daquan Zhou, Zuo-Liang Zhu, Yaxing Wang, Qibin Hou, Jiashi Feng

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.03904 2023-09-08 cs.CV 83%

Exploring Sparse MoE in GANs for Text-conditioned Image Synthesis

Jiapeng Zhu, Ceyuan Yang, Kecheng Zheng, Yinghao Xu, Zifan Shi, Yujun Shen

专题命中 文生图 :image synthesis(title,abstract);text-to-image(abstract);分类 cs.CV

Comments Technical report

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.05357 2023-08-04 cs.CV cs.AI cs.LG 83%

Unsupervised Compositional Concepts Discovery with Text-to-Image Generative Models

Nan Liu, Yilun Du, Shuang Li, Joshua B. Tenenbaum, Antonio Torralba

专题命中 文生图 :text-to-image(title,abstract);image synthesis(abstract);分类 cs.CV

Comments ICCV 2023. Project Webpage: https://energy-based-model.github.io/unsupervised-concept-discovery/

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.14896 2023-07-07 cs.CV cs.AI cs.HC cs.LG 83%

DiffusionDB: A Large-scale Prompt Gallery Dataset for Text-to-Image Generative Models

Zijie J. Wang, Evan Montoya, David Munechika, Haoyang Yang, Benjamin Hoover, Duen Horng Chau

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

Comments Accepted to ACL 2023 (nominated for best paper, top 1.6% of submissions, oral presentation). 17 pages, 11 figures. The dataset is available at https://huggingface.co/datasets/poloclub/diffusiondb. The code is at https://github.com/poloclub/diffusiondb. The interactive visualization demo is at https://poloclub.github.io/diffusiondb/explorer/

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.14525 2023-06-27 cs.CV 83%

DRAN: Detailed Region-Adaptive Normalization for Conditional Image Synthesis

Yueming Lyu, Peibin Chen, Jingna Sun, Bo Peng, Xu Wang, Jing Dong

专题命中 文生图 :image synthesis(title,abstract);image generation(abstract);分类 cs.CV

Comments Accepted by TMM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.07754 2023-06-14 cs.CV cs.CR 83%

Generative Watermarking Against Unauthorized Subject-Driven Image Synthesis

Yihan Ma, Zhengyu Zhao, Xinlei He, Zheng Li, Michael Backes, Yang Zhang

专题命中 文生图 :image synthesis(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.05500 2023-06-12 cs.CL cs.AI cs.CV cs.LG 83%

Word-Level Explanations for Analyzing Bias in Text-to-Image Models

Alexander Lin, Lucas Monteiro Paes, Sree Harsha Tanneru, Suraj Srinivas, Himabindu Lakkaraju

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

Comments 5 main pages, 3 pages in appendix, and 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.18398 2023-05-31 cs.CV cs.AI cs.LG 83%

Mitigating Inappropriateness in Image Generation: Can there be Value in Reflecting the World's Ugliness?

Manuel Brack, Felix Friedrich, Patrick Schramowski, Kristian Kersting

专题命中 文生图 :image generation(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.14384 2023-05-25 cs.LG cs.AI cs.CR cs.CV 83%

Adversarial Nibbler: A Data-Centric Challenge for Improving the Safety of Text-to-Image Models

Alicia Parrish, Hannah Rose Kirk, Jessica Quaye, Charvi Rastogi, Max Bartolo, Oana Inel, Juan Ciro, Rafael Mosquera, Addison Howard, Will Cukierski, D. Sculley, Vijay Janapa Reddi, Lora Aroyo

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.08821 2023-04-19 cs.CV cs.CL cs.LG 83%

TTIDA: Controllable Generative Data Augmentation via Text-to-Text and Text-to-Image Models

Yuwei Yin, Jean Kaddour, Xiang Zhang, Yixin Nie, Zhenguang Liu, Lingpeng Kong, Qi Liu

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.02321 2023-04-06 cs.CV 83%

Few-shot Semantic Image Synthesis with Class Affinity Transfer

Marlène Careil, Jakob Verbeek, Stéphane Lathuilière

专题命中 文生图 :image synthesis(title,abstract);diffusion(abstract);分类 cs.CV

Comments Accepted to CVPR 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.09005 2023-03-17 cs.CV cs.LG 83%

Conditional Synthetic Food Image Generation

Wenjin Fu, Yue Han, Jiangpeng He, Sriram Baireddy, Mridul Gupta, Fengqing Zhu

专题命中 文生图 :image generation(title,abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.12192 2023-02-24 cs.LG cs.AI cs.CV 83%

Aligning Text-to-Image Models using Human Feedback

Kimin Lee, Hao Liu, Moonkyung Ryu, Olivia Watkins, Yuqing Du, Craig Boutilier, Pieter Abbeel, Mohammad Ghavamzadeh, Shixiang Shane Gu

专题命中 文生图 :text-to-image(title,abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.14286 2023-02-07 cs.CV cs.LG 83%

CHIMLE: Conditional Hierarchical IMLE for Multimodal Conditional Image Synthesis

Shichong Peng, Alireza Moazeni, Ke Li

专题命中 文生图 :image synthesis(title,abstract);diffusion(abstract);分类 cs.CV

Comments More results and code are available on the project website at https://niopeng.github.io/CHIMLE/

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.07476 2023-01-24 cs.IR cs.CL cs.CV 83%

The Infinite Index: Information Retrieval on Generative Text-To-Image Models

Niklas Deckers, Maik Fröbe, Johannes Kiesel, Gianluca Pandolfo, Christopher Schröder, Benno Stein, Martin Potthast

专题命中 文生图 :text-to-image(title);image generation(abstract);diffusion(abstract);分类 cs.CV

Comments Final version for CHIIR 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2301.05465 2023-01-16 cs.CV cs.LG 83%

Explicit Temporal Embedding in Deep Generative Latent Models for Longitudinal Medical Image Synthesis

Julian Schön, Raghavendra Selvan, Lotte Nygård, Ivan Richter Vogelius, Jens Petersen

专题命中 文生图 :image synthesis(title,abstract);image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.15663 2022-11-29 cs.CV 83%

Hand-Object Interaction Image Generation

Hezhen Hu, Weilun Wang, Wengang Zhou, Houqiang Li

专题命中 文生图 :image generation(title,abstract);image synthesis(abstract);分类 cs.CV

Comments Accepted by NeurIPS 2022 (Spotlight); Project Page: https://play-with-hoi-generation.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.04085 2022-10-11 cs.CV 83%

Dual Pyramid Generative Adversarial Networks for Semantic Image Synthesis

Shijie Li, Ming-Ming Cheng, Juergen Gall

专题命中 文生图 :image synthesis(title,abstract);image editing(abstract);分类 cs.CV

Comments BMVC2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.13518 2022-08-30 cs.AI cs.CL cs.CV cs.LO cs.SC 83%

LogicRank: Logic Induced Reranking for Generative Text-to-Image Systems

Björn Deiseroth, Patrick Schramowski, Hikaru Shindo, Devendra Singh Dhami, Kristian Kersting

专题命中 文生图 :text-to-image(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2207.00762 2022-08-02 cs.CV cs.AI 83%

Backdoor Attack is a Devil in Federated GAN-based Medical Image Synthesis

Ruinan Jin, Xiaoxiao Li

专题命中 文生图 :image synthesis(title,abstract);image generation(abstract);分类 cs.CV

Comments 13 pages, 4 figures, Accepted by MICCAI 2022 SASHIMI Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2112.10762 2022-07-22 cs.CV 83%

StyleSwin: Transformer-based GAN for High-resolution Image Generation

Bowen Zhang, Shuyang Gu, Bo Zhang, Jianmin Bao, Dong Chen, Fang Wen, Yong Wang, Baining Guo

专题命中 文生图 :image generation(title,abstract);image synthesis(abstract);分类 cs.CV

Comments CVPR 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2206.04029 2022-06-13 cs.CV cs.LG 83%

Accelerating Score-based Generative Models for High-Resolution Image Synthesis

Hengyuan Ma, Li Zhang, Xiatian Zhu, Jingfeng Zhang, Jianfeng Feng

专题命中 文生图 :image synthesis(title);image generation(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2104.00464 2022-05-16 cs.CV eess.IV 83%

Improved Image Generation via Sparse Modeling

Roy Ganz, Michael Elad

专题命中 文生图 :image generation(title,abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2204.12678 2022-04-28 cs.CV 83%

Optimized latent-code selection for explainable conditional text-to-image GANs

Zhenxing Zhang, Lambert Schomaker

专题命中 文生图 :text-to-image(title,abstract);image generation(abstract);分类 cs.CV

Comments arXiv admin note: substantial text overlap with arXiv:2202.12929

详情

展开后加载摘要…

URL PDF HTML 收藏