arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 3480 信号源:cs.CV, cs.GR, cs.MM

1. 文生图 3480 篇

2307.09233 2024-07-02 cs.CV 83%

Distilling Knowledge from Text-to-Image Generative Models Improves Visio-Linguistic Reasoning in CLIP

Samyadeep Basu, Shell Xu Hu, Maziar Sanjabi, Daniela Massiceti, Soheil Feizi

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

Comments Short paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.00138 2024-07-02 cs.AI cs.CV 83%

Analyzing Quality, Bias, and Performance in Text-to-Image Generative Models

Nila Masrourisaadat, Nazanin Sedaghatkish, Fatemeh Sarshartehrani, Edward A. Fox

专题命中 文生图 :text-to-image(title,abstract);image synthesis(abstract);分类 cs.CV

Comments 20 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.18893 2024-07-01 cs.CV 83%

AlignIT: Enhancing Prompt Alignment in Customization of Text-to-Image Models

Aishwarya Agarwal, Srikrishna Karanam, Balaji Vasan Srinivasan

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

Comments 10 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.14993 2024-06-24 cs.CV cs.CL 83%

Disability Representations: Finding Biases in Automatic Image Generation

Yannis Tevissen

专题命中 文生图 :image generation(title,abstract);text-to-image(abstract);分类 cs.CV

Comments Presented at AVA Workshop of CVPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.11988 2024-06-19 cs.CV cs.AI cs.CY cs.LG 83%

Decomposed evaluations of geographic disparities in text-to-image models

Abhishek Sureddy, Dishant Padalia, Nandhinee Periyakaruppa, Oindrila Saha, Adina Williams, Adriana Romero-Soriano, Megan Richards, Polina Kirichenko, Melissa Hall

专题命中 文生图 :text-to-image(title);image generation(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.05478 2024-06-11 cs.CV cs.AI 83%

Revisiting Non-Autoregressive Transformers for Efficient Image Synthesis

Zanlin Ni, Yulin Wang, Renping Zhou, Jiayi Guo, Jinyi Hu, Zhiyuan Liu, Shiji Song, Yuan Yao, Gao Huang

专题命中 文生图 :image synthesis(title,abstract);diffusion(abstract);分类 cs.CV

Comments Accepted by CVPR2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.11237 2024-06-05 cs.CV 83%

Not Just Pretty Pictures: Toward Interventional Data Augmentation Using Text-to-Image Generators

Jianhao Yuan, Francesco Pinto, Adam Davies, Philip Torr

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

Comments 29 pages, 16 figures

Journal ref ICML 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.17069 2024-05-28 cs.CV cs.LG 83%

Training-free Editioning of Text-to-Image Models

Jinqi Wang, Yunfei Fu, Zhangcan Ding, Bailin Deng, Yu-Kun Lai, Yipeng Qin

专题命中 文生图 :text-to-image(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.13473 2024-05-28 cs.CV cs.AI 83%

Class-Conditional self-reward mechanism for improved Text-to-Image models

Safouane El Ghazouali, Arnaud Gucciardi, Umberto Michelucci

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.13870 2024-05-24 cs.CV 83%

FreeCustom: Tuning-Free Customized Image Generation for Multi-Concept Composition

Ganggui Ding, Canyu Zhao, Wen Wang, Zhen Yang, Zide Liu, Hao Chen, Chunhua Shen

专题命中 文生图 :image generation(title,abstract);text-to-image(abstract);分类 cs.CV

Comments CVPR2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.13779 2024-05-24 cs.CV cs.AI cs.LG 83%

Robust Disaster Assessment from Aerial Imagery Using Text-to-Image Synthetic Data

Tarun Kalluri, Jihyeon Lee, Kihyuk Sohn, Sahil Singla, Manmohan Chandraker, Joseph Xu, Jeremiah Liu

专题命中 文生图 :text-to-image(title,abstract);image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.01008 2024-05-09 cs.CV 83%

On Mechanistic Knowledge Localization in Text-to-Image Generative Models

Samyadeep Basu, Keivan Rezaei, Priyatham Kattakinda, Ryan Rossi, Cherry Zhao, Vlad Morariu, Varun Manjunatha, Soheil Feizi

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

Comments Appearing in ICML 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.16002 2024-05-09 cs.CV 83%

Integrating View Conditions for Image Synthesis

Jinbin Bai, Zhen Dong, Aosong Feng, Xiao Zhang, Tian Ye, Kaicheng Zhou

专题命中 文生图 :image synthesis(title,abstract);image editing(abstract);分类 cs.CV

Comments Accepted by IJCAI 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.00738 2024-05-08 cs.CL cs.CV 83%

ReFACT: Updating Text-to-Image Models by Editing the Text Encoder

Dana Arad, Hadas Orgad, Yonatan Belinkov

专题命中 文生图 :text-to-image(title,abstract);image generation(abstract);分类 cs.CV

Comments Accepted to NAACL 2024 (Main Conference)

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.10329 2024-05-06 cs.CV cs.AI 83%

High-fidelity Person-centric Subject-to-Image Synthesis

Yibin Wang, Weizhong Zhang, Jianwei Zheng, Cheng Jin

专题命中 文生图 :image synthesis(title);image generation(abstract);diffusion(abstract);分类 cs.CV

Comments Accepted by CVPR2024. Code: https://github.com/CodeGoat24/Face-diffuser

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.01356 2024-05-03 cs.CV 83%

Improving Subject-Driven Image Synthesis with Subject-Agnostic Guidance

Kelvin C. K. Chan, Yang Zhao, Xuhui Jia, Ming-Hsuan Yang, Huisheng Wang

专题命中 文生图 :image synthesis(title,abstract);text-to-image(abstract);分类 cs.CV

Comments Accepted to CVPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.18409 2024-04-30 cs.CV 83%

PKU-AIGIQA-4K: A Perceptual Quality Assessment Database for Both Text-to-Image and Image-to-Image AI-Generated Images

Jiquan Yuan, Fanyi Yang, Jihe Li, Xinyan Cao, Jinming Che, Jinlong Lin, Xixin Cao

专题命中 文生图 :text-to-image(title,abstract);image generation(abstract);分类 cs.CV

Comments 12 pages. arXiv admin note: substantial text overlap with arXiv:2311.15556

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.09812 2024-04-24 cs.CV 83%

DreamMatcher: Appearance Matching Self-Attention for Semantically-Consistent Text-to-Image Personalization

Jisu Nam, Heesu Kim, DongJae Lee, Siyoon Jin, Seungryong Kim, Seunggyu Chang

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

Comments Project page is available at https://ku-cvlab.github.io/DreamMatcher/

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.08030 2024-04-15 cs.CV cs.AI 83%

Rethinking Artistic Copyright Infringements in the Era of Text-to-Image Generative Models

Mazda Moayeri, Samyadeep Basu, Sriram Balasubramanian, Priyatham Kattakinda, Atoosa Chengini, Robert Brauneis, Soheil Feizi

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.07676 2024-04-12 cs.CV cs.AI 83%

Model-based Cleaning of the QUILT-1M Pathology Dataset for Text-Conditional Image Synthesis

Marc Aubreville, Jonathan Ganz, Jonas Ammeling, Christopher C. Kaltenecker, Christof A. Bertram

专题命中 文生图 :image synthesis(title,abstract);text-to-image(abstract);分类 cs.CV

Comments 4 pages (short paper)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.01294 2024-04-02 cs.CV 83%

CosmicMan: A Text-to-Image Foundation Model for Humans

Shikai Li, Jianglin Fu, Kaiyuan Liu, Wentao Wang, Kwan-Yee Lin, Wayne Wu

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

Comments Accepted by CVPR 2024. The supplementary material is included. Project Page: https://cosmicman-cvpr2024.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.14155 2024-03-22 cs.CV 83%

Harmonizing Visual and Textual Embeddings for Zero-Shot Text-to-Image Customization

Yeji Song, Jimyeong Kim, Wonhark Park, Wonsik Shin, Wonjong Rhee, Nojun Kwak

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

Comments Project page: https://ldynx.github.io/harmony-zero-t2i/

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.06198 2024-03-19 cs.CV cs.HC 83%

DIG In: Evaluating Disparities in Image Generations with Indicators for Geographic Diversity

Melissa Hall, Candace Ross, Adina Williams, Nicolas Carion, Michal Drozdzal, Adriana Romero Soriano

专题命中 文生图 :image generation(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.06952 2024-03-12 cs.CV cs.AI cs.CL cs.LG 83%

SELMA: Learning and Merging Skill-Specific Text-to-Image Experts with Auto-Generated Data

Jialu Li, Jaemin Cho, Yi-Lin Sung, Jaehong Yoon, Mohit Bansal

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

Comments First two authors contributed equally; Project website: https://selma-t2i.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.05578 2024-03-12 cs.HC cs.AI cs.CV cs.IR cs.LG 83%

Chaining text-to-image and large language model: A novel approach for generating personalized e-commerce banners

Shanu Vashishtha, Abhinav Prakash, Lalitesh Morishetti, Kaushiki Nag, Yokila Arora, Sushant Kumar, Kannan Achan

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.15516 2024-02-09 cs.CL cs.AI cs.CV 83%

Teaching Text-to-Image Models to Communicate in Dialog

Xiaowen Sun, Jiazhan Feng, Yuxuan Wang, Yuxuan Lai, Xingyu Shen, Dongyan Zhao

专题命中 文生图 :text-to-image(title,abstract);image generation(abstract);分类 cs.CV

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.04116 2024-01-10 cs.HC cs.CV 83%

Semantic Draw Engineering for Text-to-Image Creation

Yang Li, Huaqiang Jiang, Yangkai Wu

专题命中 文生图 :text-to-image(title,abstract);image generation(abstract);分类 cs.CV

Comments 6pages, 5 figures

Journal ref Journal of Advances in Information Science and Technology, Volume 1, Issue 1, 2023, Pages 1-6

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.17274 2024-01-01 cs.CV cs.AI cs.LG 83%

RefineNet: Enhancing Text-to-Image Conversion with High-Resolution and Detail Accuracy through Hierarchical Transformers and Progressive Refinement

Fan Shi

专题命中 文生图 :text-to-image(title,abstract);image generation(abstract);分类 cs.CV

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.11826 2023-12-20 cs.CV 83%

Decoupled Textual Embeddings for Customized Image Generation

Yufei Cai, Yuxiang Wei, Zhilong Ji, Jinfeng Bai, Hu Han, Wangmeng Zuo

专题命中 文生图 :image generation(title,abstract);text-to-image(abstract);分类 cs.CV

Comments 16 pages, 16 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.06453 2023-12-12 cs.CV eess.IV 83%

Semantic Image Synthesis for Abdominal CT

Yan Zhuang, Benjamin Hou, Tejas Sudharshan Mathai, Pritam Mukherjee, Boah Kim, Ronald M. Summers

专题命中 文生图 :image synthesis(title,abstract);diffusion(abstract);分类 cs.CV

Comments This paper has been accepted at Deep Generative Models workshop at MICCAI 2023

详情

展开后加载摘要…

URL PDF HTML 收藏