arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 4201 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 4201 篇

2411.15966 2025-10-13 cs.CV 74%

Gaussian Scenes: Pose-Free Sparse-View Scene Reconstruction using Depth-Enhanced Diffusion Priors

Soumava Paul, Prakhar Kaushik, Alan Yuille

机构 * CCVL, Johns Hopkins University(CCVL,约翰霍普金斯大学)

专题命中 可控生成 :diffusion(title);分类 cs.CV

Comments Accepted to TMLR 2025. Code and models released at https://gaussianscenes.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11375 2025-08-18 eess.IV cs.CV 74%

AnatoMaskGAN: GNN-Driven Slice Feature Fusion and Noise Augmentation for Medical Semantic Image Synthesis

Zonglin Wu, Yule Xue, Qianxiang Hu, Yaoyao Feng, Yuqi Ma, Shanxiong Chen

机构 * College of Computer and Information Science, Southwest University(计算机与信息科学学院,西南大学)

专题命中 可控生成 :image synthesis(title);分类 cs.CV

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06065 2025-08-11 cs.HC cs.AI cs.CL cs.CV 74%

ThematicPlane: Bridging Tacit User Intent and Latent Spaces for Image Generation

Daniel Lee, Nikhil Sharma, Donghoon Shin, DaEun Choi, Harsh Sharma, Jeonghwan Kim, Heng Ji

机构 * Adobe Inc.(Adobe公司) Johns Hopkins University(约翰霍普金斯大学) University of Washington(华盛顿大学) University of Colorado(科罗拉多大学) University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 可控生成 :image generation(title);分类 cs.CV

Journal ref In Adjunct Proceedings of the 38th Annual ACM Symposium on User Interface Software and Technology (UIST '25), Sept 28-Oct 1, 2025, Busan, Republic of Korea. ACM, New York, NY, USA

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.16421 2025-08-01 cs.CV 74%

Learning from Rendering: Realistic and Controllable Extreme Rainy Image Synthesis for Autonomous Driving Simulation

Kaibin Zhou, Kaifeng Huang, Hao Deng, Zelin Tao, Ziniu Liu, Lin Zhang, Shengjie Zhao

机构 * School of Computer Science and Technology, Tongji University(计算机科学与技术学院,同济大学)

专题命中 可控生成 :image synthesis(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.01493 2025-06-10 cs.CV 74%

Learning Temporally Consistent Video Depth from Video Diffusion Priors

Jiahao Shao, Yuanbo Yang, Hongyu Zhou, Youmin Zhang, Yujun Shen, Vitor Guizilini, Yue Wang, Matteo Poggi, Yiyi Liao

机构 * Zhejiang University(浙江大学) University of Bologna(博洛尼亚大学) University of Southern California(南加州大学) Ant Group(蚂蚁集团) Toyota Research Institute(丰田研究院) Rock Universe AI

专题命中 可控生成 :diffusion(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.11785 2025-04-07 cs.CV 74%

InterDyn: Controllable Interactive Dynamics with Video Diffusion Models

Rick Akkerman, Haiwen Feng, Michael J. Black, Dimitrios Tzionas, Victoria Fernández Abrevaya

专题命中 可控生成 :diffusion(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16579 2025-03-24 cs.CV cs.RO 74%

World Knowledge from AI Image Generation for Robot Control

Jonas Krumme, Christoph Zetzsche

专题命中 可控生成 :image generation(title);分类 cs.CV

Comments 9 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16068 2025-03-21 cs.CV 74%

PoseTraj: Pose-Aware Trajectory Control in Video Diffusion

Longbin Ji, Lei Zhong, Pengfei Wei, Changjian Li

专题命中 可控生成 :diffusion(title);分类 cs.CV

Comments Code, data and project page: https://robingg1.github.io/Pose-Traj/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07493 2025-03-11 cs.CV cs.AI 74%

V2Flow: Unifying Visual Tokenization and Large Language Model Vocabularies for Autoregressive Image Generation

Guiwei Zhang, Tianyu Zhang, Mohan Zhou, Yalong Bai, Biye Li

专题命中 可控生成 :image generation(title);分类 cs.CV

Comments 11 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.06919 2025-03-11 eess.IV cs.CV 74%

CAFusion: Controllable Anatomical Synthesis of Perirectal Lymph Nodes via SDF-guided Diffusion

Weidong Guo, Hantao Zhang, Shouhong Wan, Bingbing Zou, Wanqin Wang, Chenyang Qiu, Peiquan Jin

专题命中 可控生成 :diffusion(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01101 2025-02-18 cs.CV cs.AI 74%

VidSketch: Hand-drawn Sketch-Driven Video Generation with Diffusion Control

Lifan Jiang, Shuang Chen, Boxi Wu, Xiaotong Guan, Jiahui Zhang

专题命中 可控生成 :diffusion(title);分类 cs.CV

Comments 17pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.19303 2024-12-30 cs.CV 74%

Manga Generation via Layout-controllable Diffusion

Siyu Chen, Dengjie Li, Zenghao Bao, Yao Zhou, Lingfeng Tan, Yujie Zhong, Zheng Zhao

专题命中 可控生成 :diffusion(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.18229 2024-11-28 cs.CV 74%

SharpDepth: Sharpening Metric Depth Predictions Using Diffusion Distillation

Duc-Hai Pham, Tung Do, Phong Nguyen, Binh-Son Hua, Khoi Nguyen, Rang Nguyen

专题命中 可控生成 :diffusion(title);分类 cs.CV

Comments Uncompressed version can be found in https://drive.google.com/file/d/1MG4-d_xDERVBCRfLDolNLnMLLuqd7qRz

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.13437 2024-10-31 cs.CV 74%

High-fidelity Endoscopic Image Synthesis by Utilizing Depth-guided Neural Surfaces

Baoru Huang, Yida Wang, Anh Nguyen, Daniel Elson, Francisco Vasconcelos, Danail Stoyanov

专题命中 可控生成 :image synthesis(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.11592 2024-10-23 cs.CV 74%

ChildDiffusion: Unlocking the Potential of Generative AI and Controllable Augmentations for Child Facial Data using Stable Diffusion and Large Language Models

Muhammad Ali Farooq, Wang Yao, Peter Corcoran

专题命中 可控生成 :diffusion(title);分类 cs.CV

Comments This work has been submitted to the IEEE Transactions Journal for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.10774 2024-10-15 cs.CV 74%

Cavia: Camera-controllable Multi-view Video Diffusion with View-Integrated Attention

Dejia Xu, Yifan Jiang, Chen Huang, Liangchen Song, Thorsten Gernoth, Liangliang Cao, Zhangyang Wang, Hao Tang

专题命中 可控生成 :diffusion(title);分类 cs.CV

Comments Project Page: https://ir1d.github.io/Cavia/

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.07422 2024-09-12 eess.IV cs.CV 74%

Controllable retinal image synthesis using conditional StyleGAN and latent space manipulation for improved diagnosis and grading of diabetic retinopathy

Somayeh Pakdelmoez, Saba Omidikia, Seyyed Ali Seyyedsalehi, Seyyede Zohreh Seyyedsalehi

专题命中 可控生成 :image synthesis(title);分类 cs.CV

Comments 30 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.00707 2024-08-02 cs.CV cs.CE cs.LG 74%

Synthetic dual image generation for reduction of labeling efforts in semantic segmentation of micrographs with a customized metric function

Matias Oscar Volman Stern, Dominic Hohs, Andreas Jansche, Timo Bernthaler, Gerhard Schneider

专题命中 可控生成 :image generation(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.19370 2024-07-30 cs.CV 74%

ClickDiff: Click to Induce Semantic Contact Map for Controllable Grasp Generation with Diffusion Models

Peiming Li, Ziyi Wang, Mengyuan Liu, Hong Liu, Chen Chen

专题命中 可控生成 :diffusion(title);分类 cs.CV

Comments ACM Multimedia 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.10762 2024-07-16 cs.CV eess.IV 74%

Domain Generalization for 6D Pose Estimation Through NeRF-based Image Synthesis

Antoine Legrand, Renaud Detry, Christophe De Vleeschouwer

专题命中 可控生成 :image synthesis(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.19085 2024-05-30 cs.AI cs.CV 74%

Patch-enhanced Mask Encoder Prompt Image Generation

Shusong Xu, Peiye Liu

专题命中 可控生成 :image generation(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.00896 2024-04-10 cs.CV 74%

TrailBlazer: Trajectory Control for Diffusion-Based Video Generation

Wan-Duo Kurt Ma, J. P. Lewis, W. Bastiaan Kleijn

专题命中 可控生成 :diffusion(title);分类 cs.CV

Comments 14 pages, 18 figures, Project Page: https://hohonu-vicml.github.io/Trailblazer.Page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2301.04634 2024-02-14 cs.CV 74%

Street-View Image Generation from a Bird's-Eye View Layout

Alexander Swerdlow, Runsheng Xu, Bolei Zhou

专题命中 可控生成 :image generation(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.16933 2023-11-29 cs.CV 74%

SparseCtrl: Adding Sparse Controls to Text-to-Video Diffusion Models

Yuwei Guo, Ceyuan Yang, Anyi Rao, Maneesh Agrawala, Dahua Lin, Bo Dai

专题命中 可控生成 :diffusion(title);分类 cs.CV

Comments Project page: https://guoyww.github.io/projects/SparseCtrl

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.13551 2023-10-10 cs.HC cs.AI cs.GR 74%

Dance with You: The Diversity Controllable Dancer Generation via Diffusion Models

Siyue Yao, Mingjie Sun, Bingliang Li, Fengyu Yang, Junle Wang, Ruimao Zhang

专题命中 可控生成 :diffusion(title);分类 cs.GR

Comments Accepted by ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.00761 2023-10-03 cs.CV cs.LG eess.IV 74%

Counterfactual Image Generation for adversarially robust and interpretable Classifiers

Rafael Bischof, Florian Scheidegger, Michael A. Kraus, A. Cristiano I. Malossi

专题命中 可控生成 :image generation(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2301.04604 2023-09-26 cs.CV 74%

LinkGAN: Linking GAN Latents to Pixels for Controllable Image Synthesis

Jiapeng Zhu, Ceyuan Yang, Yujun Shen, Zifan Shi, Bo Dai, Deli Zhao, Qifeng Chen

专题命中 可控生成 :image synthesis(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.07378 2023-09-26 cs.CV cs.AI 74%

3DHumanGAN: 3D-Aware Human Image Generation with 3D Pose Mapping

Zhuoqian Yang, Shikai Li, Wayne Wu, Bo Dai

专题命中 可控生成 :image generation(title);分类 cs.CV

Comments 9 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.04800 2023-09-12 cs.CV 74%

VeRi3D: Generative Vertex-based Radiance Fields for 3D Controllable Human Image Synthesis

Xinya Chen, Jiaxin Huang, Yanrui Bin, Lu Yu, Yiyi Liao

专题命中 可控生成 :image synthesis(title);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.09621 2023-07-20 cs.CV 74%

Conditional 360-degree Image Synthesis for Immersive Indoor Scene Decoration

Ka Chun Shum, Hong-Wing Pang, Binh-Son Hua, Duc Thanh Nguyen, Sai-Kit Yeung

专题命中 可控生成 :image synthesis(title);分类 cs.CV

Comments ICCV2023

详情

展开后加载摘要…

URL PDF HTML 收藏