arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 4200 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 4200 篇

2408.13623 2025-08-12 cs.CV 85%

Prompt-Softbox-Prompt: A Free-Text Embedding Control for Image Editing

Yitong Yang, Yinglin Wang, Tian Zhang, Jing Wang, Shuting He

机构 * Shanghai University of Finance and Economics(上海财经大学) School of Computing and Artificial Intelligence(计算机与人工智能学院) MoE Key Laboratory of Interdisciplinary Research of Computation and Economics(交叉计算与经济学联合实验室)

专题命中 可控生成 :image editing(title,abstract);image generation(abstract);diffusion(abstract);分类 cs.CV

Comments ACM MM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.04152 2025-07-08 cs.CV 85%

LVLM-Composer's Explicit Planning for Image Generation

Spencer Ramsey, Jeffrey Lee, Amina Grant

机构 * Northern Caribbean University(北加勒比大学)

专题命中 可控生成 :image generation(title,abstract);text-to-image(abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.16318 2025-06-16 cs.CV cs.AI 85%

One Diffusion to Generate Them All

Duong H. Le, Tuan Pham, Sangho Lee, Christopher Clark, Aniruddha Kembhavi, Stephan Mandt, Ranjay Krishna, Jiasen Lu

机构 * Allen Institute for AI(人工智能研究所) University of California, Irvine(加州大学尔湾分校) University of Washington(华盛顿大学)

专题命中 可控生成 :diffusion(title,abstract);text-to-image(abstract);image synthesis(abstract);分类 cs.CV

Comments CVPR 2025; two first authors contribute equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07883 2025-06-10 cs.LG cs.AI cs.CV stat.ML 85%

Diffusion Counterfactual Generation with Semantic Abduction

Rajat Rasal, Avinash Kori, Fabio De Sousa Ribeiro, Tian Xia, Ben Glocker

机构 * Department of Computing, Imperial College London, UK(计算系,伦敦帝国学院,英国)

专题命中 可控生成 :diffusion(title,abstract);image generation(abstract);image editing(abstract);分类 cs.CV

Comments Proceedings of the 42nd International Conference on Machine Learning, Vancouver, Canada

Journal ref PMLR 267, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20909 2025-05-28 cs.CV 85%

Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects

Wei Li, Hebei Li, Yansong Peng, Siying Wu, Yueyi Zhang, Xiaoyan Sun

机构 * MoE Key Laboratory of Brain-inspired Intelligent Perception and Cognition, University of Science and Technology of China(脑启发智能感知与认知大学科学与技术大学实验室) Institute of Artificial Intelligence, Hefei Comprehensive National Science Center(人工智能研究所)

专题命中 可控生成 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments ICME 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.04718 2025-05-09 cs.CV cs.LG 85%

Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers

Divyansh Srivastava, Xiang Zhang, He Wen, Chenru Wen, Zhuowen Tu

机构 * UC San Diego(加州大学圣地亚哥分校) Tsingua University(清华大学)

专题命中 可控生成 :diffusion(title,abstract);image generation(abstract);image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.00313 2025-05-08 cs.CV 85%

Training-Free Sketch-Guided Diffusion with Latent Optimization

Sandra Zhang Ding, Jiafeng Mao, Kiyoharu Aizawa

机构 * The University of Tokyo(东京大学)

专题命中 可控生成 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.08259 2025-04-14 cs.CV cs.AI 85%

CoProSketch: Controllable and Progressive Sketch Generation with Diffusion Model

Ruohao Zhan, Yijin Li, Yisheng He, Shuo Chen, Yichen Shen, Xinyu Chen, Zilong Dong, Zhaoyang Huang, Guofeng Zhang

专题命中 可控生成 :diffusion(title,abstract);image generation(abstract);image editing(abstract);分类 cs.CV

Comments 11 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.01595 2025-04-11 cs.CV cs.AI 85%

KnobGen: Controlling the Sophistication of Artwork in Sketch-Based Diffusion Models

Pouyan Navard, Amin Karimi Monsefi, Mengxi Zhou, Wei-Lun Chao, Alper Yilmaz, Rajiv Ramnath

专题命中 可控生成 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments Accepted to CVPR 2025 Workshop on CVEU

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.16801 2025-04-02 cs.CV 85%

Controllable Human Image Generation with Personalized Multi-Garments

Yisol Choi, Sangkyung Kwak, Sihyun Yu, Hyungwon Choi, Jinwoo Shin

专题命中 可控生成 :image generation(title,abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV

Comments CVPR 2025. Project page: https://omnious.github.io/BootComp

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.10522 2025-04-01 cs.CV cs.AI 85%

Enhancing Object Coherence in Layout-to-Image Synthesis

Yibin Wang, Changhai Zhou, Honghui Xu

专题命中 可控生成 :image synthesis(title,abstract);image generation(abstract);diffusion(abstract);分类 cs.CV

Comments Code: https://github.com/CodeGoat24/EOCNet

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.13982 2025-03-06 cs.CV cs.AI 85%

Safety Without Semantic Disruptions: Editing-free Safe Image Generation via Context-preserving Dual Latent Reconstruction

Jordan Vice, Naveed Akhtar, Mubarak Shah, Richard Hartley, Ajmal Mian

专题命中 可控生成 :image generation(title,abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV

Comments This research is supported by the NISDRG project #20100007, funded by the Australian Government

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.07209 2025-03-05 cs.CV 85%

MS-Diffusion: Multi-subject Zero-shot Image Personalization with Layout Guidance

Xierui Wang, Siming Fu, Qihan Huang, Wanggui He, Hao Jiang

专题命中 可控生成 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.09400 2025-03-04 cs.CV 85%

CtrLoRA: An Extensible and Efficient Framework for Controllable Image Generation

Yifeng Xu, Zhenliang He, Shiguang Shan, Xilin Chen

专题命中 可控生成 :image generation(title,abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV

Comments ICLR 2025. Code: https://github.com/xyfJASON/ctrlora

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.20172 2025-02-28 cs.CV cs.CL 85%

Multimodal Representation Alignment for Image Generation: Text-Image Interleaved Control Is Easier Than You Think

Liang Chen, Shuai Bai, Wenhao Chai, Weichu Xie, Haozhe Zhao, Leon Vinci, Junyang Lin, Baobao Chang

专题命中 可控生成 :image generation(title,abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV

Comments 13 pages, 9 figures, codebase in https://github.com/chenllliang/DreamEngine

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.01368 2025-01-03 cs.CV 85%

Test-time Controllable Image Generation by Explicit Spatial Constraint Enforcement

Z. Zhang, B. Liu, J. Bao, L. Chen, S. Zhu, J. Yu

专题命中 可控生成 :image generation(title,abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.10605 2024-12-17 cs.CV cs.AI 85%

MUSES: 3D-Controllable Image Generation via Multi-Modal Agent Collaboration

Yanbo Ding, Shaobin Zhuang, Kunchang Li, Zhengrong Yue, Yu Qiao, Yali Wang

专题命中 可控生成 :image generation(title,abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV

Comments AAAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06742 2024-12-11 cs.CV cs.AI 85%

ContRail: A Framework for Realistic Railway Image Synthesis using ControlNet

Andrei-Robert Alexandrescu, Razvan-Gabriel Petec, Alexandru Manole, Laura-Silvia Diosan

专题命中 可控生成 :image synthesis(title,abstract);image generation(abstract);diffusion(abstract);分类 cs.CV

Comments 9 pages, 5 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.15236 2024-11-26 cs.CV cs.LG 85%

Text Embedding is Not All You Need: Attention Control for Text-to-Image Semantic Alignment with Text Self-Attention Maps

Jeeyung Kim, Erfan Esmaeili, Qiang Qiu

专题命中 可控生成 :text-to-image(title,abstract);image generation(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.12872 2024-11-25 cs.CV cs.AI cs.LG 85%

From Text to Pose to Image: Improving Diffusion Model Control and Quality

Clément Bonnet, Ariel N. Lee, Franck Wertel, Antoine Tamano, Tanguy Cizain, Pablo Ducru

专题命中 可控生成 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments Published at the NeurIPS 2024 Workshop on Compositional Learning: Perspectives, Methods, and Paths Forward

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.04932 2024-10-08 cs.CV 85%

OmniBooth: Learning Latent Control for Image Synthesis with Multi-modal Instruction

Leheng Li, Weichao Qiu, Xu Yan, Jing He, Kaiqiang Zhou, Yingjie Cai, Qing Lian, Bingbing Liu, Ying-Cong Chen

专题命中 可控生成 :image synthesis(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.09681 2024-09-17 cs.CV 85%

E-Commerce Inpainting with Mask Guidance in Controlnet for Reducing Overcompletion

Guandong Li

专题命中 可控生成 :inpainting(title,abstract);image generation(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.04801 2024-09-10 cs.CV 85%

SpotActor: Training-Free Layout-Controlled Consistent Image Generation

Jiahao Wang, Caixia Yan, Weizhan Zhang, Haonan Lin, Mengmeng Wang, Guang Dai, Tieliang Gong, Hao Sun, Jingdong Wang

专题命中 可控生成 :image generation(title,abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.07986 2024-07-29 cs.CV cs.AI cs.LG 85%

Viewpoint Textual Inversion: Discovering Scene Representations and 3D View Control in 2D Diffusion Models

James Burgess, Kuan-Chieh Wang, Serena Yeung-Levy

专题命中 可控生成 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments ECCV 2024 (European Conference on Computer Vision). Project page: https://jmhb0.github.io/view_neti/

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.13609 2024-07-19 cs.CV cs.AI 85%

Training-free Composite Scene Generation for Layout-to-Image Synthesis

Jiaqi Liu, Tao Huang, Chang Xu

专题命中 可控生成 :image synthesis(title);image generation(abstract);text-to-image(abstract);diffusion(abstract)

Comments ECCV 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.10277 2024-07-16 cs.CV cs.AI cs.LG 85%

Disrupting Diffusion-based Inpainters with Semantic Digression

Geonho Son, Juhun Lee, Simon S. Woo

专题命中 可控生成 :diffusion(title,abstract);text-to-image(abstract);inpainting(abstract);分类 cs.CV

Comments 16 pages, 13 figures, IJCAI 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.01790 2024-07-03 cs.CV cs.AI cs.LG 85%

Label-free Neural Semantic Image Synthesis

Jiayi Wang, Kevin Alexander Laube, Yumeng Li, Jan Hendrik Metzen, Shin-I Cheng, Julio Borges, Anna Khoreva

专题命中 可控生成 :image synthesis(title,abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.09985 2024-05-17 cs.CV 85%

VirtualModel: Generating Object-ID-retentive Human-object Interaction Image by Diffusion Model for E-commerce Marketing

Binghui Chen, Chongyang Zhong, Wangmeng Xiang, Yifeng Geng, Xuansong Xie

专题命中 可控生成 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments project page: https://aigcdesigngroup.github.io/replace-anything;

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.05331 2024-04-09 cs.CV 85%

Mask-ControlNet: Higher-Quality Image Generation with An Additional Mask Prompt

Zhiqi Huang, Huixin Xiong, Haoyu Wang, Longguang Wang, Zhiheng Li

专题命中 可控生成 :image generation(title,abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.01143 2024-04-02 cs.CV cs.AI 85%

Condition-Aware Neural Network for Controlled Image Generation

Han Cai, Muyang Li, Zhuoyang Zhang, Qinsheng Zhang, Ming-Yu Liu, Song Han

专题命中 可控生成 :image generation(title,abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV

Comments CVPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏