arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 86350 信号源:cs.CV, cs.GR, cs.MM

1. 文生图 3474 篇

2411.05079 2024-11-11 cs.CV cs.CL 86%

Precision or Recall? An Analysis of Image Captions for Training Text-to-Image Generation Model

Sheng Cheng, Maitreya Patel, Yezhou Yang

专题命中 文生图 :text-to-image(title,abstract);image generation(title);分类 cs.CV

Comments EMNLP 2024 Findings. Code: https://github.com/shengcheng/Captions4T2I

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.09774 2024-11-07 cs.CV 86%

Generalizing Alignment Paradigm of Text-to-Image Generation with Preferences through $f$-divergence Minimization

Haoyuan Sun, Bo Xia, Yongzhe Chang, Xueqian Wang

专题命中 文生图 :text-to-image(title,abstract);image generation(title);分类 cs.CV

Comments 34 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.00377 2024-10-25 cs.CL cs.AI cs.CV cs.CY 86%

The Factuality Tax of Diversity-Intervened Text-to-Image Generation: Benchmark and Fact-Augmented Intervention

Yixin Wan, Di Wu, Haoran Wang, Kai-Wei Chang

专题命中 文生图 :text-to-image(title,abstract);image generation(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.10058 2024-10-15 cs.CV 86%

Learning to Customize Text-to-Image Diffusion In Diverse Context

Taewook Kim, Wei Chen, Qiang Qiu

专题命中 文生图 :text-to-image(title,abstract);diffusion(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.07464 2024-09-13 cs.CV cs.AI 86%

Reflective Human-Machine Co-adaptation for Enhanced Text-to-Image Generation Dialogue System

Yuheng Feng, Yangfan He, Yinghui Xia, Tianyu Shi, Jun Wang, Jinsong Yang

专题命中 文生图 :image generation(title,abstract);text-to-image(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.04224 2024-08-22 cs.CV 86%

Cross-View Meets Diffusion: Aerial Image Synthesis with Geometry and Text Guidance

Ahmad Arrabi, Xiaohan Zhang, Waqas Sultani, Chen Chen, Safwan Wshah

专题命中 文生图 :image synthesis(title,abstract);diffusion(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.06310 2024-07-16 cs.CV cs.CL cs.CY 86%

ViSAGe: A Global-Scale Analysis of Visual Stereotypes in Text-to-Image Generation

Akshita Jha, Vinodkumar Prabhakaran, Remi Denton, Sarah Laszlo, Shachi Dave, Rida Qadri, Chandan K. Reddy, Sunipa Dev

专题命中 文生图 :text-to-image(title,abstract);image generation(title);分类 cs.CV

Comments Association for Computational Linguistics (ACL) 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.05675 2024-07-16 cs.CV 86%

Parrot: Pareto-optimal Multi-Reward Reinforcement Learning Framework for Text-to-Image Generation

Seung Hyun Lee, Yinxiao Li, Junjie Ke, Innfarn Yoo, Han Zhang, Jiahui Yu, Qifei Wang, Fei Deng, Glenn Entis, Junfeng He, Gang Li, Sangpil Kim, Irfan Essa, Feng Yang

专题命中 文生图 :text-to-image(title,abstract);image generation(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.19668 2024-07-01 cs.CV 86%

PopAlign: Population-Level Alignment for Fair Text-to-Image Generation

Shufan Li, Harkanwar Singh, Aditya Grover

专题命中 文生图 :text-to-image(title,abstract);image generation(title);分类 cs.CV

Comments 18 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.11336 2024-05-28 cs.CV 86%

UPAM: Unified Prompt Attack in Text-to-Image Generation Models Against Both Textual Filters and Visual Checkers

Duo Peng, Qiuhong Ke, Jun Liu

专题命中 文生图 :text-to-image(title,abstract);image generation(title);分类 cs.CV

Comments Accepted by ICML2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.12075 2024-05-15 cs.CY cs.AI cs.CR cs.CV cs.LG 86%

Adversarial Nibbler: An Open Red-Teaming Method for Identifying Diverse Harms in Text-to-Image Generation

Jessica Quaye, Alicia Parrish, Oana Inel, Charvi Rastogi, Hannah Rose Kirk, Minsuk Kahng, Erin van Liemt, Max Bartolo, Jess Tsang, Justin White, Nathan Clement, Rafael Mosquera, Juan Ciro, Vijay Janapa Reddi, Lora Aroyo

专题命中 文生图 :text-to-image(title,abstract);image generation(title);分类 cs.CV

Comments 10 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.15841 2024-05-13 cs.CV 86%

Learning Disentangled Identifiers for Action-Customized Text-to-Image Generation

Siteng Huang, Biao Gong, Yutong Feng, Xi Chen, Yuqian Fu, Yu Liu, Donglin Wang

专题命中 文生图 :text-to-image(title,abstract);image generation(title);分类 cs.CV

Comments CVPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.05667 2024-05-10 eess.IV cs.CV 86%

VM-DDPM: Vision Mamba Diffusion for Medical Image Synthesis

Zhihan Ju, Wanting Zhou

专题命中 文生图 :image synthesis(title,abstract);diffusion(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.01030 2024-05-03 cs.CV cs.AI cs.CY 86%

Survey of Bias In Text-to-Image Generation: Definition, Evaluation, and Mitigation

Yixin Wan, Arjun Subramonian, Anaelia Ovalle, Zongyu Lin, Ashima Suvarna, Christina Chance, Hritik Bansal, Rebecca Pattichis, Kai-Wei Chang

专题命中 文生图 :text-to-image(title,abstract);image generation(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.14007 2024-04-23 cs.CV cs.AI 86%

Infusion: Preventing Customized Text-to-Image Diffusion from Overfitting

Weili Zeng, Yichao Yan, Qi Zhu, Zhuo Chen, Pengzhi Chu, Weiming Zhao, Xiaokang Yang

专题命中 文生图 :text-to-image(title,abstract);diffusion(title);分类 cs.CV

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.13766 2024-04-23 cs.CV 86%

Object-Attribute Binding in Text-to-Image Generation: Evaluation and Control

Maria Mihaela Trusca, Wolf Nuyts, Jonathan Thomm, Robert Honig, Thomas Hofmann, Tinne Tuytelaars, Marie-Francine Moens

专题命中 文生图 :image generation(title);text-to-image(title);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.15773 2024-03-26 cs.CV 86%

Check, Locate, Rectify: A Training-Free Layout Calibration System for Text-to-Image Generation

Biao Gong, Siteng Huang, Yutong Feng, Shiwei Zhang, Yuyuan Li, Yu Liu

专题命中 文生图 :image generation(title);text-to-image(title);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.18235 2024-03-15 cs.CV cs.AI cs.CL cs.LG 86%

Davidsonian Scene Graph: Improving Reliability in Fine-grained Evaluation for Text-to-Image Generation

Jaemin Cho, Yushi Hu, Roopal Garg, Peter Anderson, Ranjay Krishna, Jason Baldridge, Mohit Bansal, Jordi Pont-Tuset, Su Wang

专题命中 文生图 :text-to-image(title,abstract);image generation(title);分类 cs.CV

Comments ICLR 2024; Project website: https://google.github.io/dsg

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.08407 2024-03-14 cs.CV 86%

Iterative Online Image Synthesis via Diffusion Model for Imbalanced Classification

Shuhan Li, Yi Lin, Hao Chen, Kwang-Ting Cheng

专题命中 文生图 :image synthesis(title,abstract);diffusion(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.05408 2024-02-28 cs.CV 86%

MIGC: Multi-Instance Generation Controller for Text-to-Image Synthesis

Dewei Zhou, You Li, Fan Ma, Xiaoting Zhang, Yi Yang

专题命中 文生图 :text-to-image(title);image synthesis(title);diffusion(abstract);分类 cs.CV

Comments Accepted for publication in CVPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.04695 2024-02-26 cs.CV cs.CL cs.LG 86%

ConceptBed: Evaluating Concept Learning Abilities of Text-to-Image Diffusion Models

Maitreya Patel, Tejas Gokhale, Chitta Baral, Yezhou Yang

专题命中 文生图 :text-to-image(title,abstract);diffusion(title);分类 cs.CV

Comments Accepted at AAAI'24 | Project page: https://conceptbed.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.05134 2024-01-04 cs.CV cs.AI cs.CL cs.LG 86%

TIAM -- A Metric for Evaluating Alignment in Text-to-Image Generation

Paul Grimal, Hervé Le Borgne, Olivier Ferret, Julien Tourille

专题命中 文生图 :text-to-image(title,abstract);image generation(title);分类 cs.CV

Journal ref Proceedings of the IEEE/CVF Winter Conference on Applications of Computer Vision (WACV), 2024, pp. 2890-2899

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.11919 2023-11-21 cs.CV 86%

An Image is Worth Multiple Words: Multi-attribute Inversion for Constrained Text-to-Image Synthesis

Aishwarya Agarwal, Srikrishna Karanam, Tripti Shukla, Balaji Vasan Srinivasan

专题命中 文生图 :text-to-image(title);image synthesis(title);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.05265 2023-09-26 cs.CV cs.AI cs.CL cs.LG 86%

Controllable Textual Inversion for Personalized Text-to-Image Generation

Jianan Yang, Haobo Wang, Yanming Zhang, Ruixuan Xiao, Sai Wu, Gang Chen, Junbo Zhao

专题命中 文生图 :text-to-image(title,abstract);image generation(title);分类 cs.CV

Comments 10 pages, 6 figures, 2 tables. Project Page: https://github.com/jnzju/COTI

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.04001 2023-05-24 cs.CV cs.AI 86%

AADiff: Audio-Aligned Video Synthesis with Text-to-Image Diffusion

Seungwoo Lee, Chaerin Kong, Donghyeon Jeon, Nojun Kwak

专题命中 文生图 :diffusion(title,abstract);text-to-image(title);分类 cs.CV

Comments CVPR2023 Workshop on AI for Content Creation. Project Page: https://lifrary.github.io/AADiff/

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.13427 2023-04-27 cs.CV 86%

Training-Free Location-Aware Text-to-Image Synthesis

Jiafeng Mao, Xueting Wang

专题命中 文生图 :text-to-image(title);image synthesis(title);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.15518 2022-11-29 cs.CV 86%

ReCo: Region-Controlled Text-to-Image Generation

Zhengyuan Yang, Jianfeng Wang, Zhe Gan, Linjie Li, Kevin Lin, Chenfei Wu, Nan Duan, Zicheng Liu, Ce Liu, Michael Zeng, Lijuan Wang

专题命中 文生图 :text-to-image(title,abstract);image generation(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2008.05865 2022-10-18 cs.CV 86%

DF-GAN: A Simple and Effective Baseline for Text-to-Image Synthesis

Ming Tao, Hao Tang, Fei Wu, Xiao-Yuan Jing, Bing-Kun Bao, Changsheng Xu

专题命中 文生图 :text-to-image(title,abstract);image synthesis(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2205.11273 2022-06-22 cs.CV cs.AI 86%

GR-GAN: Gradual Refinement Text-to-image Generation

Bo Yang, Fangxiang Feng, Xiaojie Wang

专题命中 文生图 :text-to-image(title,abstract);image generation(title);分类 cs.CV

Comments Accepted by ICME 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2204.14217 2022-05-30 cs.CV cs.LG 86%

CogView2: Faster and Better Text-to-Image Generation via Hierarchical Transformers

Ming Ding, Wendi Zheng, Wenyi Hong, Jie Tang

专题命中 文生图 :text-to-image(title,abstract);image generation(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏