arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 3480 信号源:cs.CV, cs.GR, cs.MM

1. 文生图 3480 篇

2401.01951 2024-12-06 cs.CV cs.AI cs.LG 83%

GeoPos: A Minimal Positional Encoding for Enhanced Fine-Grained Details in Image Synthesis Using Convolutional Neural Networks

Mehran Hosseini, Peyman Hosseini

专题命中 文生图 :image synthesis(title);image generation(abstract);diffusion(abstract);分类 cs.CV

Comments Accepted at WACV 2025. Contains 19 pages, 15 figures, and 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.18301 2024-11-28 cs.CV 83%

Enhancing MMDiT-Based Text-to-Image Models for Similar Subject Generation

Tianyi Wei, Dongdong Chen, Yifan Zhou, Xingang Pan

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.17066 2024-11-27 cs.CV cs.CL cs.SC 83%

Relations, Negations, and Numbers: Looking for Logic in Generative Text-to-Image Models

Colin Conwell, Rupert Tawiah-Quashie, Tomer Ullman

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.10913 2024-11-19 cs.CV cs.LG 83%

Generating Compositional Scenes via Text-to-image RGBA Instance Generation

Alessandro Fontanella, Petru-Daniel Tudosiu, Yongxin Yang, Shifeng Zhang, Sarah Parisot

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

Comments NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.14704 2024-11-18 cs.CV cs.AI cs.CL 83%

VLEU: a Method for Automatic Evaluation for Generalizability of Text-to-Image Models

Jingtao Cao, Zheng Zhang, Hongru Wang, Kam-Fai Wong

专题命中 文生图 :text-to-image(title,abstract);image synthesis(abstract);分类 cs.CV

Comments accepted by EMNLP2024(long paper,main conference)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.00321 2024-11-11 cs.CV 83%

A Cat Is A Cat (Not A Dog!): Unraveling Information Mix-ups in Text-to-Image Encoders through Causal Analysis and Embedding Optimization

Chieh-Yun Chen, Chiang Tseng, Li-Wu Tsao, Hong-Han Shuai

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

Comments Accepted to NeurIPS 2024 (https://neurips.cc/virtual/2024/poster/94705)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.02068 2024-11-05 cs.LG cs.CV 83%

Model Integrity when Unlearning with T2I Diffusion Models

Andrea Schioppa, Emiel Hoogeboom, Jonathan Heek

专题命中 文生图 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.04312 2024-11-01 cs.CV 83%

ReNO: Enhancing One-step Text-to-Image Models through Reward-based Noise Optimization

Luca Eyring, Shyamgopal Karthik, Karsten Roth, Alexey Dosovitskiy, Zeynep Akata

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

Comments NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.17664 2024-10-24 eess.IV cs.CV 83%

Deep Generative Models for 3D Medical Image Synthesis

Paul Friedrich, Yannik Frisch, Philippe C. Cattin

专题命中 文生图 :image synthesis(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.14201 2024-10-21 cs.HC cs.CV 83%

Text-to-Image Representativity Fairness Evaluation Framework

Asma Yamani, Malak Baslyman

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.13863 2024-10-18 cs.CV cs.LG 83%

Fluid: Scaling Autoregressive Text-to-image Generative Models with Continuous Tokens

Lijie Fan, Tianhong Li, Siyang Qin, Yuanzhen Li, Chen Sun, Michael Rubinstein, Deqing Sun, Kaiming He, Yonglong Tian

专题命中 文生图 :text-to-image(title,abstract);image generation(abstract);分类 cs.CV

Comments Tech report

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.13136 2024-10-18 cs.CV 83%

Unlocking the Capabilities of Masked Generative Models for Image Synthesis via Self-Guidance

Jiwan Hur, Dong-Jae Lee, Gyojin Han, Jaehyun Choi, Yunho Jeon, Junmo Kim

专题命中 文生图 :image synthesis(title,abstract);diffusion(abstract);分类 cs.CV

Comments NeurIPS 2024. Code is available at: https://github.com/JiwanHur/UnlockMGM

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.07884 2024-10-11 cs.CV cs.CY 83%

Generated Bias: Auditing Internal Bias Dynamics of Text-To-Image Generative Models

Abhishek Mandal, Susan Leavy, Suzanne Little

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.07763 2024-10-11 cs.CV cs.AI 83%

HARIVO: Harnessing Text-to-Image Models for Video Generation

Mingi Kwon, Seoung Wug Oh, Yang Zhou, Difan Liu, Joon-Young Lee, Haoran Cai, Baqiao Liu, Feng Liu, Youngjung Uh

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

Comments ECCV2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.16562 2024-10-11 cs.CV cs.CL 83%

EVALALIGN: Supervised Fine-Tuning Multimodal LLMs with Human-Aligned Data for Evaluating Text-to-Image Models

Zhiyu Tan, Xiaomeng Yang, Luozheng Qin, Mengping Yang, Cheng Zhang, Hao Li

专题命中 文生图 :text-to-image(title,abstract);image generation(abstract);分类 cs.CV

Comments Project page: https://sais-fuxi.github.io/projects/evalalign/

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.06841 2024-10-10 cs.CV 83%

Boosting Few-Shot Detection with Large Language Models and Layout-to-Image Synthesis

Ahmed Abdullah, Nikolas Ebert, Oliver Wasenmüller

专题命中 文生图 :image synthesis(title,abstract);diffusion(abstract);分类 cs.CV

Comments This paper has been accepted at the Asian Conference on Computer Vision (ACCV), 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.03430 2024-10-07 cs.CV cs.CL 83%

Images Speak Volumes: User-Centric Assessment of Image Generation for Accessible Communication

Miriam Anschütz, Tringa Sylaj, Georg Groh

专题命中 文生图 :image generation(title,abstract);text-to-image(abstract);分类 cs.CV

Comments To be published at TSAR workshop 2024 (https://tsar-workshop.github.io/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.00483 2024-10-02 cs.CV cs.AI 83%

MCGM: Mask Conditional Text-to-Image Generative Model

Rami Skaik, Leonardo Rossi, Tomaso Fontanini, Andrea Prati

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

Comments 17 pages, 13 figures, presented at the 5th International Conference on Artificial Intelligence and Machine Learning (CAIML 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.02332 2024-09-30 cs.CV cs.AI 83%

Efficient Exploration of Image Classifier Failures with Bayesian Optimization and Text-to-Image Models

Adrien LeCoz, Houssem Ouertatani, Stéphane Herbin, Faouzi Adjed

专题命中 文生图 :text-to-image(title,abstract);image generation(abstract);分类 cs.CV

Journal ref Generative Models for Computer Vision - CVPR 2024 Workshop, Jun 2024, Seattle, United States

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.17439 2024-09-27 cs.CV cs.LG 83%

Rejection Sampling IMLE: Designing Priors for Better Few-Shot Image Synthesis

Chirag Vashist, Shichong Peng, Ke Li

专题命中 文生图 :image synthesis(title);image generation(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.11802 2024-09-24 cs.CV 83%

PhyBench: A Physical Commonsense Benchmark for Evaluating Text-to-Image Models

Fanqing Meng, Wenqi Shao, Lixin Luo, Yahong Wang, Yiran Chen, Quanfeng Lu, Yue Yang, Tianshuo Yang, Kaipeng Zhang, Yu Qiao, Ping Luo

专题命中 文生图 :text-to-image(title,abstract);image generation(abstract);分类 cs.CV

Comments Some low-quality data and comments may mislead readers to understand the paper. We are working hard to correct these problems and resubmit the paper after making the necessary revisions

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.12314 2024-09-20 cs.CR cs.AI cs.CV cs.LG 83%

Understanding Implosion in Text-to-Image Generative Models

Wenxin Ding, Cathy Y. Li, Shawn Shan, Ben Y. Zhao, Haitao Zheng

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

Comments ACM CCS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.16700 2024-08-30 cs.CV 83%

GradBias: Unveiling Word Influence on Bias in Text-to-Image Generative Models

Moreno D'Incà, Elia Peruzzo, Massimiliano Mancini, Xingqian Xu, Humphrey Shi, Nicu Sebe

专题命中 文生图 :text-to-image(title,abstract);image generation(abstract);分类 cs.CV

Comments Under review. Code: https://github.com/Moreno98/GradBias

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.15914 2024-08-29 cs.CV 83%

CoRe: Context-Regularized Text Embedding Learning for Text-to-Image Personalization

Feize Wu, Yun Pang, Junyi Zhang, Lianyu Pang, Jian Yin, Baoquan Zhao, Qing Li, Xudong Mao

专题命中 文生图 :text-to-image(title,abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.09432 2024-08-20 eess.IV cs.AI cs.CV 83%

Deformation-aware GAN for Medical Image Synthesis with Substantially Misaligned Pairs

Bowen Xin, Tony Young, Claire E Wainwright, Tamara Blake, Leo Lebrat, Thomas Gaass, Thomas Benkert, Alto Stemmer, David Coman, Jason Dowling

专题命中 文生图 :image synthesis(title,abstract);image generation(abstract);分类 cs.CV

Comments Accepted by MIDL2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.19524 2024-08-19 cs.CV cs.AI 83%

VersusDebias: Universal Zero-Shot Debiasing for Text-to-Image Models via SLM-Based Prompt Engineering and Generative Adversary

Hanjun Luo, Ziye Deng, Haoyu Huang, Xuecheng Liu, Ruizhe Chen, Zuozhu Liu

专题命中 文生图 :text-to-image(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.07990 2024-08-06 cs.CV cs.AI 83%

OpenBias: Open-set Bias Detection in Text-to-Image Generative Models

Moreno D'Incà, Elia Peruzzo, Massimiliano Mancini, Dejia Xu, Vidit Goel, Xingqian Xu, Zhangyang Wang, Humphrey Shi, Nicu Sebe

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

Comments CVPR 2024 Highlight - Code: https://github.com/Picsart-AI-Research/OpenBias

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.01181 2024-08-05 cs.CV 83%

VAR-CLIP: Text-to-Image Generator with Visual Auto-Regressive Modeling

Qian Zhang, Xiangzi Dai, Ninghua Yang, Xiang An, Ziyong Feng, Xingyu Ren

专题命中 文生图 :text-to-image(title,abstract);image generation(abstract);分类 cs.CV

Comments total 10 pages, code:https://github.com/daixiangzi/VAR-CLIP

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.00283 2024-08-02 cs.CL cs.CV 83%

Navigating Text-to-Image Generative Bias across Indic Languages

Surbhi Mittal, Arnav Sudan, Mayank Vatsa, Richa Singh, Tamar Glaser, Tal Hassner

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

Comments Accepted in ECCV 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.02158 2024-07-08 cs.CV 83%

UltraPixel: Advancing Ultra-High-Resolution Image Synthesis to New Peaks

Jingjing Ren, Wenbo Li, Haoyu Chen, Renjing Pei, Bin Shao, Yong Guo, Long Peng, Fenglong Song, Lei Zhu

专题命中 文生图 :image synthesis(title);image generation(abstract);diffusion(abstract);分类 cs.CV

Comments Project page https://jingjingrenabc.github.io/ultrapixel

详情

展开后加载摘要…

URL PDF HTML 收藏