arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 86350 信号源:cs.CV, cs.GR, cs.MM

1. 文生图 3474 篇

2507.11947 2025-07-17 cs.CV cs.AI 86%

RaDL: Relation-aware Disentangled Learning for Multi-Instance Text-to-Image Generation

Geon Park, Seon Bin Kim, Gunho Jung, Seong-Whan Lee

机构 * Department of Artificial Intelligence, Korea University(人工智能系,韩国大学)

专题命中 文生图 :text-to-image(title,abstract);image generation(title);分类 cs.CV

Comments 6 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15203 2025-07-17 cs.CV cs.AI 86%

FlipConcept: Tuning-Free Multi-Concept Personalization for Text-to-Image Generation

Young Beom Woo, Sun Eung Kim, Seong-Whan Lee

机构 * Department of Artificial Intelligence, Korea University(人工智能系,韩国大学)

专题命中 文生图 :text-to-image(title,abstract);image generation(title);分类 cs.CV

Comments Accepted by IEEE SMC 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.07079 2025-07-10 cs.CV 86%

Evaluating Attribute Confusion in Fashion Text-to-Image Generation

Ziyue Liu, Federico Girella, Yiming Wang, Davide Talon

机构 * University of Verona(威尼斯大学) Polytechnic University of Turin(都灵理工大学) Fondazione Bruno Kessler(布鲁诺·科塞勒基金会)

专题命中 文生图 :text-to-image(title,abstract);image generation(title);分类 cs.CV

Comments Accepted to ICIAP25. Project page: site [https://intelligolabs.github.io/L-VQAScore/\

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02973 2025-07-08 cs.CV 86%

Mimesis, Poiesis, and Imagination: Exploring Text-to-Image Generation of Biblical Narratives

Willem Th. van Peursen, Samuel E. Entsua-Mensah

专题命中 文生图 :text-to-image(title,abstract);image generation(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.10493 2025-07-01 cs.CV cs.AI cs.LG 86%

AlignGuard: Scalable Safety Alignment for Text-to-Image Generation

Runtao Liu, I Chieh Chen, Jindong Gu, Jipeng Zhang, Renjie Pi, Qifeng Chen, Philip Torr, Ashkan Khakzar, Fabio Pizzati

专题命中 文生图 :text-to-image(title,abstract);image generation(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23011 2025-06-10 cs.CV cs.AI 86%

Geometrical Properties of Text Token Embeddings for Strong Semantic Binding in Text-to-Image Generation

Hoigi Seo, Junseo Bang, Haechang Lee, Joohoon Lee, Byung Hyun Lee, Se Young Chun

专题命中 文生图 :text-to-image(title,abstract);image generation(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.14896 2025-06-09 cs.CV cs.AI 86%

A Comprehensive Survey on Concept Erasure in Text-to-Image Diffusion Models

Changhoon Kim, Yanjun Qi

机构 * Soongsil University(松趾大学) University of Virginia(弗吉尼亚大学)

专题命中 文生图 :text-to-image(title,abstract);diffusion(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.10419 2025-05-29 cs.CV cs.AI cs.CL cs.LG cs.SY eess.SY 86%

Preference Adaptive and Sequential Text-to-Image Generation

Ofir Nabati, Guy Tennenholtz, ChihWei Hsu, Moonkyung Ryu, Deepak Ramachandran, Yinlam Chow, Xiang Li, Craig Boutilier

机构 * International Conference on Machine Learning (ICML 2025)(国际机器学习会议)

专题命中 文生图 :text-to-image(title,abstract);image generation(title);分类 cs.CV

Comments Accepted to ICML 2025 Link to PASTA dataset: https://www.kaggle.com/datasets/googleai/pasta-data

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18730 2025-05-27 cs.CV 86%

Align Beyond Prompts: Evaluating World Knowledge Alignment in Text-to-Image Generation

Wenchao Zhang, Jiahe Tian, Runze He, Jizhong Han, Jiao Dai, Miaomiao Feng, Wei Mi, Xiaodan Zhang

机构 * Institute of Information Engineering, Chinese Academy of Sciences(信息工程研究所,中国科学院)

专题命中 文生图 :text-to-image(title,abstract);image generation(title);分类 cs.CV

Comments Code: https://github.com/smile365317/ABP

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17540 2025-05-26 cs.CV cs.AI 86%

RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning

Mingrui Wu, Lu Wang, Pu Zhao, Fangkai Yang, Jianjin Zhang, Jianfeng Liu, Yuefeng Zhan, Weihao Han, Hao Sun, Jiayi Ji, Xiaoshuai Sun, Qingwei Lin, Weiwei Deng, Dongmei Zhang, Feng Sun, Qi Zhang, Rongrong Ji

机构 * Key Laboratory of Multimedia Trusted Perception and Efficient Computing, Ministry of Education of China, Xiamen University(多媒体可信感知与高效计算重点实验室,教育部,厦门大学) Microsoft(微软)

专题命中 文生图 :text-to-image(title,abstract);image generation(title);分类 cs.CV

Comments Code is available at: https://github.com/microsoft/DKI_LLM/tree/main/RePrompt

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15172 2025-05-22 cs.CV 86%

Harnessing Caption Detailness for Data-Efficient Text-to-Image Generation

Xinran Wang, Muxi Diao, Yuanzhi Liu, Chunyu Wang, Kongming Liang, Zhanyu Ma, Jun Guo

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Zhongguancun Academy(中关村学院)

专题命中 文生图 :text-to-image(title,abstract);image generation(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12129 2025-04-24 cs.CV 86%

Anti-Aesthetics: Protecting Facial Privacy against Customized Text-to-Image Synthesis

Songping Wang, Yueming Lyu, Shiqi Liu, Ning Li, Tong Tong, Hao Sun, Caifeng Shan

专题命中 文生图 :text-to-image(title);image synthesis(title);diffusion(abstract);分类 cs.CV

Comments After the submission of the paper, we realized that the study still has room for expansion. In order to make the research findings more profound and comprehensive, we have decided to withdraw the paper so that we can conduct further research and expansion

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.01515 2025-04-21 cs.CV cs.AI 86%

Training-free Dense-Aligned Diffusion Guidance for Modular Conditional Image Synthesis

Zixuan Wang, Duo Peng, Feng Chen, Yuwei Yang, Yinjie Lei

专题命中 文生图 :image synthesis(title,abstract);diffusion(title);分类 cs.CV

Comments Accepted by CVPR2025

Journal ref Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10358 2025-03-14 cs.CV cs.LG 86%

ConceptGuard: Continual Personalized Text-to-Image Generation with Forgetting and Confusion Mitigation

Zirun Guo, Tao Jin

专题命中 文生图 :image generation(title);text-to-image(title);diffusion(abstract);分类 cs.CV

Comments Accepted at CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12691 2025-03-12 cs.CV 86%

Spherical Dense Text-to-Image Synthesis

Timon Winter, Stanislav Frolov, Brian Bernhard Moser, Andreas Dengel

专题命中 文生图 :text-to-image(title,abstract);image synthesis(title);分类 cs.CV

Comments Link to project page https://sdt2i.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.14062 2025-03-11 cs.CV cs.AI cs.CL cs.LG 86%

MMGenBench: Fully Automatically Evaluating LMMs from the Text-to-Image Generation Perspective

Hailang Huang, Yong Wang, Zixuan Huang, Huaqiu Li, Tongwen Huang, Xiangxiang Chu, Richong Zhang

专题命中 文生图 :text-to-image(title,abstract);image generation(title);分类 cs.CV

Comments This project is available at: https://github.com/lerogo/MMGenBench

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.16423 2025-02-25 cs.CV 86%

Unified Prompt Attack Against Text-to-Image Generation Models

Duo Peng, Qiuhong Ke, Mark He Huang, Ping Hu, Jun Liu

专题命中 文生图 :text-to-image(title,abstract);image generation(title);分类 cs.CV

Comments Accepted by IEEE T-PAMI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10663 2025-02-21 cs.MM 86%

REAL: Realism Evaluation of Text-to-Image Generation Models for Effective Data Augmentation

Ran Li, Xiaomeng Jin, Heng ji

专题命中 文生图 :text-to-image(title,abstract);image generation(title);分类 cs.MM

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.12784 2025-02-11 cs.CV cs.AI 86%

Evaluating Image Hallucination in Text-to-Image Generation with Question-Answering

Youngsun Lim, Hojun Choi, Hyunjung Shim

专题命中 文生图 :text-to-image(title,abstract);image generation(title);分类 cs.CV

Comments 20 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01507 2025-02-04 cs.CV 86%

End-to-end Training for Text-to-Image Synthesis using Dual-Text Embeddings

Yeruru Asrar Ahmed, Anurag Mittal

专题命中 文生图 :text-to-image(title,abstract);image synthesis(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.06481 2025-01-14 cs.CV 86%

Focus-N-Fix: Region-Aware Fine-Tuning for Text-to-Image Generation

Xiaoying Xing, Avinab Saha, Junfeng He, Susan Hao, Paul Vicol, Moonkyung Ryu, Gang Li, Sahil Singla, Sarah Young, Yinxiao Li, Feng Yang, Deepak Ramachandran

专题命中 文生图 :text-to-image(title,abstract);image generation(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.03567 2025-01-09 cs.CV 86%

Evaluating Image Caption via Cycle-consistent Text-to-Image Generation

Tianyu Cui, Jinbin Bai, Guo-Hua Wang, Qing-Guo Chen, Zhao Xu, Weihua Luo, Kaifu Zhang, Ye Shi

专题命中 文生图 :text-to-image(title,abstract);image generation(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.02523 2025-01-07 cs.CV cs.AI 86%

Face-MakeUp: Multimodal Facial Prompts for Text-to-Image Generation

Dawei Dai, Mingming Jia, Yinxiu Zhou, Hang Xing, Chenghang Li

专题命中 文生图 :image generation(title);text-to-image(title);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.16227 2024-12-24 cs.CV cs.LG 86%

GALOT: Generative Active Learning via Optimizable Zero-shot Text-to-image Generation

Hanbin Hong, Shenao Yan, Shuya Feng, Yan Yan, Yuan Hong

专题命中 文生图 :text-to-image(title,abstract);image generation(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.10882 2024-12-13 cs.CV cs.CL 86%

Universal Prompt Optimizer for Safe Text-to-Image Generation

Zongyu Wu, Hongcheng Gao, Yueze Wang, Xiang Zhang, Suhang Wang

专题命中 文生图 :text-to-image(title,abstract);image generation(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.05722 2024-12-10 cs.CV 86%

Evaluating Hallucination in Text-to-Image Diffusion Models with Scene-Graph based Question-Answering Agent

Ziyuan Qin, Dongjie Cheng, Haoyu Wang, Huahui Yi, Yuting Shao, Zhiyuan Fan, Kang Li, Qicheng Lao

专题命中 文生图 :text-to-image(title,abstract);diffusion(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.02368 2024-12-04 cs.AI cs.CL cs.CV 86%

ScImage: How Good Are Multimodal Large Language Models at Scientific Text-to-Image Generation?

Leixin Zhang, Steffen Eger, Yinjie Cheng, Weihe Zhai, Jonas Belouadi, Christoph Leiter, Simone Paolo Ponzetto, Fahimeh Moafian, Zhixue Zhao

专题命中 文生图 :image generation(title,abstract);text-to-image(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.17176 2024-11-27 cs.CV cs.AI 86%

ChatGen: Automatic Text-to-Image Generation From FreeStyle Chatting

Chengyou Jia, Changliang Xia, Zhuohang Dang, Weijia Wu, Hangwei Qian, Minnan Luo

专题命中 文生图 :text-to-image(title,abstract);image generation(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.15509 2024-11-26 cs.CV cs.AI 86%

Interactive Visual Assessment for Text-to-Image Generation Models

Xiaoyue Mi, Fan Tang, Juan Cao, Qiang Sheng, Ziyao Huang, Peng Li, Yang Liu, Tong-Yee Lee

专题命中 文生图 :text-to-image(title,abstract);image generation(title);分类 cs.CV

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.07132 2024-11-12 cs.CV cs.AI 86%

Token Merging for Training-Free Semantic Binding in Text-to-Image Synthesis

Taihang Hu, Linxuan Li, Joost van de Weijer, Hongcheng Gao, Fahad Shahbaz Khan, Jian Yang, Ming-Ming Cheng, Kai Wang, Yaxing Wang

专题命中 文生图 :text-to-image(title,abstract);image synthesis(title);分类 cs.CV

Comments Accepted by Neurips2024

详情

展开后加载摘要…

URL PDF HTML 收藏