arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 4201 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 4201 篇

2503.04050 2025-03-07 cs.CV 83%

Underlying Semantic Diffusion for Effective and Efficient In-Context Learning

Zhong Ji, Weilong Cao, Yan Zhang, Yanwei Pang, Jungong Han, Xuelong Li

专题命中 可控生成 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01667 2025-03-04 cs.CV 83%

ToLo: A Two-Stage, Training-Free Layout-To-Image Generation Framework For High-Overlap Layouts

Linhao Huang, Jing Yu

专题命中 可控生成 :image generation(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01294 2025-03-04 cs.CV cs.AI 83%

Fine-Grained Controllable Apparel Showcase Image Generation via Garment-Centric Outpainting

Rong Zhang, Jingnan Wang, Zhiwen Zuo, Jianfeng Dong, Wei Li, Chi Wang, Weiwei Xu, Xun Wang

专题命中 可控生成 :image generation(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.12390 2025-01-23 cs.CV 83%

GPS as a Control Signal for Image Generation

Chao Feng, Ziyang Chen, Aleksander Holynski, Alexei A. Efros, Andrew Owens

专题命中 可控生成 :image generation(title,abstract);diffusion(abstract);分类 cs.CV

Comments Project page: https://cfeng16.github.io/gps-gen/

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.04847 2025-01-14 cs.CV 83%

Rethinking The Training And Evaluation of Rich-Context Layout-to-Image Generation

Jiaxin Cheng, Zixu Zhao, Tong He, Tianjun Xiao, Yicong Zhou, Zheng Zhang

专题命中 可控生成 :image generation(title,abstract);image editing(abstract);分类 cs.CV

Comments Accepted in NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.01973 2025-01-10 cs.CV cs.AI cs.CY 83%

INFELM: In-depth Fairness Evaluation of Large Text-To-Image Models

Di Jin, Xing Liu, Yu Liu, Jia Qing Yap, Andrea Wong, Adriana Crespo, Qi Lin, Zhiyuan Yin, Qiang Yan, Ryan Ye

专题命中 可控生成 :text-to-image(title,abstract);image generation(abstract);分类 cs.CV

Comments Di Jin and Xing Liu contributed equally to this work

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.16540 2024-12-30 cs.CV 83%

GRPose: Learning Graph Relations for Human Image Generation with Pose Priors

Xiangchen Yin, Donglin Di, Lei Fan, Hao Li, Wei Chen, Xiaofei Gou, Yang Song, Xiao Sun, Xun Yang

专题命中 可控生成 :image generation(title,abstract);diffusion(abstract);分类 cs.CV

Comments Accepted at AAAI2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.08486 2024-12-13 cs.CV 83%

Learning Flow Fields in Attention for Controllable Person Image Generation

Zijian Zhou, Shikun Liu, Xiao Han, Haozhe Liu, Kam Woh Ng, Tian Xie, Yuren Cong, Hang Li, Mengmeng Xu, Juan-Manuel Pérez-Rúa, Aditya Patel, Tao Xiang, Miaojing Shi, Sen He

专题命中 可控生成 :image generation(title,abstract);diffusion(abstract);分类 cs.CV

Comments github: https://github.com/franciszzj/Leffa, demo: https://huggingface.co/spaces/franciszzj/Leffa, model: https://huggingface.co/franciszzj/Leffa

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06029 2024-12-10 cs.CV 83%

Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training

Zhenghong Zhou, Jie An, Jiebo Luo

专题命中 可控生成 :diffusion(title,abstract);inpainting(abstract);分类 cs.CV

Comments Project Page: https://latent-reframe.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.02690 2024-12-06 cs.CV 83%

FoundHand: Large-Scale Domain-Specific Learning for Controllable Hand Image Generation

Kefan Chen, Chaerin Min, Linguang Zhang, Shreyas Hampali, Cem Keskin, Srinath Sridhar

专题命中 可控生成 :image generation(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.02960 2024-12-05 cs.CV 83%

Semantic Segmentation Prior for Diffusion-Based Real-World Super-Resolution

Jiahua Xiao, Jiawei Zhang, Dongqing Zou, Xiaodan Zhang, Jimmy Ren, Xing Wei

专题命中 可控生成 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.01223 2024-12-03 cs.CV cs.AI 83%

PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control

Ruichen Wang, Junliang Zhang, Qingsong Xie, Chen Chen, Haonan Lu

专题命中 可控生成 :inpainting(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.15252 2024-11-26 cs.CV cs.AI 83%

LocRef-Diffusion:Tuning-Free Layout and Appearance-Guided Generation

Fan Deng, Yaguang Wu, Xinyang Yu, Xiangjun Huang, Jian Yang, Guangyu Yan, Qiang Xu

专题命中 可控生成 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.06692 2024-11-12 cs.CV 83%

Layout Control and Semantic Guidance with Attention Loss Backward for T2I Diffusion Model

Guandong Li

专题命中 可控生成 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.09240 2024-10-24 eess.IV cs.CV 83%

XReal: Realistic Anatomy and Pathology-Aware X-ray Generation via Controllable Diffusion Model

Anees Ur Rehman Hashmi, Ibrahim Almakky, Mohammad Areeb Qazi, Santosh Sanjeev, Vijay Ram Papineni, Jagalpathy Jagdish, Mohammad Yaqub

专题命中 可控生成 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.14021 2024-09-24 cs.CV cs.AI 83%

BrainDreamer: Reasoning-Coherent and Controllable Image Generation from EEG Brain Signals via Language Guidance

Ling Wang, Chen Wu, Lin Wang

专题命中 可控生成 :image generation(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.09896 2024-09-17 cs.CV cs.LG eess.IV 83%

GRIN: Zero-Shot Metric Depth with Pixel-Level Diffusion

Vitor Guizilini, Pavel Tokmakov, Achal Dave, Rares Ambrus

专题命中 可控生成 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.13005 2024-09-17 cs.CV 83%

EasyControl: Transfer ControlNet to Video Diffusion for Controllable Generation and Interpolation

Cong Wang, Jiaxi Gu, Panwen Hu, Haoyu Zhao, Yuanfan Guo, Jianhua Han, Hang Xu, Xiaodan Liang

专题命中 可控生成 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.14339 2024-08-27 cs.CV 83%

ConceptMix: A Compositional Image Generation Benchmark with Controllable Difficulty

Xindi Wu, Dingli Yu, Yangsibo Huang, Olga Russakovsky, Sanjeev Arora

专题命中 可控生成 :image generation(title,abstract);text-to-image(abstract);分类 cs.CV

Comments 43 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.18034 2024-07-26 cs.CV cs.AI 83%

AttentionHand: Text-driven Controllable Hand Image Generation for 3D Hand Reconstruction in the Wild

Junho Park, Kyeongbo Kong, Suk-Ju Kang

专题命中 可控生成 :image generation(title,abstract);diffusion(abstract);分类 cs.CV

Comments Accepted by ECCV 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.09512 2024-07-25 cs.CV 83%

Magic Clothing: Controllable Garment-Driven Image Synthesis

Weifeng Chen, Tao Gu, Yuhao Xu, Chengcai Chen

专题命中 可控生成 :image synthesis(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.16698 2024-07-24 cs.CV 83%

Diffusion Models for Monocular Depth Estimation: Overcoming Challenging Conditions

Fabio Tosi, Pierluigi Zama Ramirez, Matteo Poggi

专题命中 可控生成 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments ECCV 2024. Code: https://github.com/fabiotosi92/Diffusion4RobustDepth Project page: https://diffusion4robustdepth.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.13631 2024-07-09 cs.CV 83%

Diff-Oracle: Deciphering Oracle Bone Scripts with Controllable Diffusion Model

Jing Li, Qiu-Feng Wang, Siyuan Wang, Rui Zhang, Kaizhu Huang, Erik Cambria

专题命中 可控生成 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.05871 2024-06-11 cs.CV cs.LG 83%

OmniControlNet: Dual-stage Integration for Conditional Image Generation

Yilin Wang, Haiyang Xu, Xiang Zhang, Zeyuan Chen, Zhizhou Sha, Zirui Wang, Zhuowen Tu

专题命中 可控生成 :image generation(title,abstract);text-to-image(abstract);分类 cs.CV

Comments Accepted to CVPR 2024 Workshop: Generative Models for Computer Vision

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.01334 2024-06-04 cs.CV 83%

HHMR: Holistic Hand Mesh Recovery by Enhancing the Multimodal Controllability of Graph Diffusion Models

Mengcheng Li, Hongwen Zhang, Yuxiang Zhang, Ruizhi Shao, Tao Yu, Yebin Liu

专题命中 可控生成 :diffusion(title,abstract);inpainting(abstract);分类 cs.CV

Comments accepted in CVPR2024, project page: https://dw1010.github.io/project/HHMR/HHMR.html

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.15267 2024-04-24 cs.CV 83%

From Parts to Whole: A Unified Reference Framework for Controllable Human Image Generation

Zehuan Huang, Hongxing Fan, Lipeng Wang, Lu Sheng

专题命中 可控生成 :image generation(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.18453 2024-04-22 eess.IV cs.CV cs.LG 83%

Conditional Diffusion Models for Semantic 3D Brain MRI Synthesis

Zolnamar Dorjsembe, Hsing-Kuo Pao, Sodtavilan Odonchimed, Furen Xiao

专题命中 可控生成 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments This document is a preprint and has been accepted for publication in the IEEE Journal of Biomedical and Health Informatics. The final, published version can be accessed using the following DOI: 10.1109/JBHI.2024.3385504. Copyright for this article has been transferred to IEEE

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.07564 2024-04-12 cs.CV 83%

ObjBlur: A Curriculum Learning Approach With Progressive Object-Level Blurring for Improved Layout-to-Image Generation

Stanislav Frolov, Brian B. Moser, Sebastian Palacio, Andreas Dengel

专题命中 可控生成 :image generation(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.04828 2024-04-09 cs.CV 83%

Strictly-ID-Preserved and Controllable Accessory Advertising Image Generation

Youze Xue, Binghui Chen, Yifeng Geng, Xuansong Xie, Jiansheng Chen, Hongbing Ma

专题命中 可控生成 :image generation(title,abstract);text-to-image(abstract);分类 cs.CV

Comments 22 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.16496 2024-04-09 cs.CV 83%

CCEdit: Creative and Controllable Video Editing via Diffusion Models

Ruoyu Feng, Wenming Weng, Yanhui Wang, Yuhui Yuan, Jianmin Bao, Chong Luo, Zhibo Chen, Baining Guo

专题命中 可控生成 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏