arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 86350 信号源:cs.CV, cs.GR, cs.MM

1. 文生图 3474 篇

2309.09466 2024-01-22 cs.CV 89%

Progressive Text-to-Image Diffusion with Soft Latent Direction

YuTeng Ye, Jiale Cai, Hang Zhou, Guanwen Li, Youjia Zhang, Zikai Song, Chenxing Gao, Junqing Yu, Wei Yang

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments 14 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.10182 2024-01-17 cs.HC cs.AI cs.CV 89%

Using Text-to-Image Generation for Architectural Design Ideation

Ville Paananen, Jonas Oppenlaender, Aku Visuri

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.06345 2024-01-15 cs.CV 89%

Seek for Incantations: Towards Accurate Text-to-Image Diffusion Synthesis through Prompt Engineering

Chang Yu, Junran Peng, Xiangyu Zhu, Zhaoxiang Zhang, Qi Tian, Zhen Lei

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.04608 2024-01-10 cs.CV 89%

EmoGen: Emotional Image Content Generation with Text-to-Image Diffusion Models

Jingyuan Yang, Jiawei Feng, Hui Huang

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.05977 2023-12-29 cs.CV cs.LG 89%

ImageReward: Learning and Evaluating Human Preferences for Text-to-Image Generation

Jiazheng Xu, Xiao Liu, Yuchen Wu, Yuxuan Tong, Qinkai Li, Ming Ding, Jie Tang, Yuxiao Dong

专题命中 文生图 :text-to-image(title,abstract);image generation(title);diffusion(abstract);image synthesis(abstract)

Comments 32 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.14988 2023-12-27 cs.CV 89%

Emage: Non-Autoregressive Text-to-Image Generation

Zhangyin Feng, Runyi Hu, Liangxin Liu, Fan Zhang, Duyu Tang, Yong Dai, Xiaocheng Feng, Jiwei Li, Bing Qin, Shuming Shi

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.12807 2023-12-21 cs.CV cs.AI 89%

All but One: Surgical Concept Erasing with Model Preservation in Text-to-Image Diffusion Models

Seunghoo Hong, Juhun Lee, Simon S. Woo

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments Main paper with supplementary materials

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.10701 2023-12-21 cs.CV 89%

Personalization as a Shortcut for Few-Shot Backdoor Attack against Text-to-Image Diffusion Models

Yihao Huang, Felix Juefei-Xu, Qing Guo, Jie Zhang, Yutong Wu, Ming Hu, Tianlin Li, Geguang Pu, Yang Liu

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);image synthesis(abstract);分类 cs.CV

Comments 16 pages, accepted by AAAI 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.12416 2023-12-20 cs.CV cs.LG 89%

Prompting Hard or Hardly Prompting: Prompt Inversion for Text-to-Image Diffusion Models

Shweta Mahajan, Tanzila Rahman, Kwang Moo Yi, Leonid Sigal

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.04326 2023-12-20 cs.CV 89%

iDesigner: A High-Resolution and Complex-Prompt Following Text-to-Image Diffusion Model for Interior Design

Ruyi Gan, Xiaojun Wu, Junyu Lu, Yuanhe Tian, Dixiang Zhang, Ziwei Wu, Renliang Sun, Chang Liu, Jiaxing Zhang, Pingjian Zhang, Yan Song

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.10854 2023-12-19 cs.CV cs.LG 89%

The Right Losses for the Right Gains: Improving the Semantic Consistency of Deep Text-to-Image Generation with Distribution-Sensitive Losses

Mahmoud Ahmed, Omer Moussa, Ismail Shaheen, Mohamed Abdelfattah, Amr Abdalla, Marwan Eid, Hesham Eraqi, Mohamed Moustafa

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.07951 2023-12-14 cs.CV 89%

Semantic-aware Data Augmentation for Text-to-image Synthesis

Zhaorui Tan, Xi Yang, Kaizhu Huang

专题命中 文生图 :text-to-image(title,abstract);image synthesis(title,abstract);diffusion(abstract);分类 cs.CV

Comments Accepted by AAAI24

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.00971 2023-12-08 cs.CV cs.AI 89%

ViCo: Plug-and-play Visual Condition for Personalized Text-to-image Generation

Shaozhe Hao, Kai Han, Shihao Zhao, Kwan-Yee K. Wong

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.05427 2023-12-06 cs.CV 89%

Grounded Text-to-Image Synthesis with Attention Refocusing

Quynh Phung, Songwei Ge, Jia-Bin Huang

专题命中 文生图 :text-to-image(title,abstract);image synthesis(title,abstract);diffusion(abstract);分类 cs.CV

Comments Project page: https://attention-refocusing.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.17937 2023-12-01 cs.CV 89%

Unlocking Spatial Comprehension in Text-to-Image Diffusion Models

Mohammad Mahdi Derakhshani, Menglin Xia, Harkirat Behl, Cees G. M. Snoek, Victor Rühle

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.14631 2023-12-01 cs.CV 89%

CatVersion: Concatenating Embeddings for Diffusion-Based Text-to-Image Personalization

Ruoyu Zhao, Mingrui Zhu, Shiyin Dong, Nannan Wang, Xinbo Gao

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments For the project page, please visit https://royzhao926.github.io/CatVersion-page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.05189 2023-11-30 cs.CL cs.CV 89%

SUR-adapter: Enhancing Text-to-Image Pre-trained Diffusion Models with Large Language Models

Shanshan Zhong, Zhongzhan Huang, Wushao Wen, Jinghui Qin, Liang Lin

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments accepted by ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.08687 2023-11-07 cs.CV cs.AI 89%

Norm-guided latent space exploration for text-to-image generation

Dvir Samuel, Rami Ben-Ari, Nir Darshan, Haggai Maron, Gal Chechik

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

Comments Accepted to NeurIPS 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.06347 2023-10-11 cs.CV 89%

JointNet: Extending Text-to-Image Diffusion for Dense Distribution Modeling

Jingyang Zhang, Shiwei Li, Yuanxun Lu, Tian Fang, David McKinnon, Yanghai Tsin, Long Quan, Yao Yao

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.02291 2023-09-21 cs.CV 89%

Progressive Text-to-Image Generation

Zhengcong Fei, Mingyuan Fan, Li Zhu, Junshi Huang

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);image synthesis(abstract);分类 cs.CV

Comments Technique report

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.04430 2023-09-11 cs.CV cs.AI 89%

Create Your World: Lifelong Text-to-Image Diffusion

Gan Sun, Wenqi Liang, Jiahua Dong, Jun Li, Zhengming Ding, Yang Cong

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments 15 pages,10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2202.04053 2023-09-01 cs.CV cs.AI cs.CL 89%

DALL-Eval: Probing the Reasoning Skills and Social Biases of Text-to-Image Generation Models

Jaemin Cho, Abhay Zala, Mohit Bansal

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

Comments ICCV 2023 (34 pages; see appendix for version changelog)

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.08157 2023-08-17 cs.CV 89%

Learning to Generate Semantic Layouts for Higher Text-Image Correspondence in Text-to-Image Synthesis

Minho Park, Jooyeol Yun, Seunghwan Choi, Jaegul Choo

专题命中 文生图 :text-to-image(title,abstract);image synthesis(title);image generation(abstract);diffusion(abstract)

Comments Accepted to ICCV 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.13873 2023-08-17 cs.CV cs.CR cs.CY cs.LG cs.SI 89%

Unsafe Diffusion: On the Generation of Unsafe Images and Hateful Memes From Text-To-Image Models

Yiting Qu, Xinyue Shen, Xinlei He, Michael Backes, Savvas Zannettou, Yang Zhang

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);image editing(abstract);分类 cs.CV

Comments To Appear in the ACM Conference on Computer and Communications Security, November 26, 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.06721 2023-08-15 cs.CV cs.AI 89%

IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models

Hu Ye, Jun Zhang, Sibo Liu, Xiao Han, Wei Yang

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.05095 2023-08-15 cs.CV cs.AI 89%

LayoutLLM-T2I: Eliciting Layout Guidance from LLM for Text-to-Image Generation

Leigang Qu, Shengqiong Wu, Hao Fei, Liqiang Nie, Tat-Seng Chua

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

Comments Accepted by ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.03507 2023-07-19 cs.CV cs.CY 89%

Ensuring Visual Commonsense Morality for Text-to-Image Generation

Seongbeom Park, Suhong Moon, Jinkyu Kim

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

Comments Workshop on Challenges in Deployable Generative AI at ICML 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.05977 2023-07-13 cs.CV cs.AI cs.LG 89%

Towards Safe Self-Distillation of Internet-Scale Text-to-Image Diffusion Models

Sanghyun Kim, Seohyeon Jung, Balhae Kim, Moonseok Choi, Jinwoo Shin, Juho Lee

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments 17 pages, 13 figures, ICML 2023 Workshop on Challenges in Deployable Generative AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.13754 2023-06-27 cs.CV 89%

Zero-shot spatial layout conditioning for text-to-image diffusion models

Guillaume Couairon, Marlène Careil, Matthieu Cord, Stéphane Lathuilière, Jakob Verbeek

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.10533 2023-06-21 cs.CV 89%

Point-Cloud Completion with Pretrained Text-to-image Diffusion Models

Yoni Kasten, Ohad Rahamim, Gal Chechik

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏