arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 4210 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 4210 篇

2409.06535 2024-09-11 cs.CV 70%

PoseEmbroider: Towards a 3D, Visual, Semantic-aware Human Pose Representation

Ginger Delmas, Philippe Weinzaepfel, Francesc Moreno-Noguer, Grégory Rogez

专题命中 可控生成 :image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments Published in ECCV 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.06074 2024-09-11 cs.CV 70%

SVS-GAN: Leveraging GANs for Semantic Video Synthesis

Khaled M. Seyam, Julian Wiederer, Markus Braun, Bin Yang

专题命中 可控生成 :diffusion(abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.03154 2024-09-05 cs.CV cs.AI 70%

ViscoNet: Bridging and Harmonizing Visual and Textual Conditioning for ControlNet

Soon Yau Cheong, Armin Mustafa, Andrew Gilbert

专题命中 可控生成 :image generation(abstract);text-to-image(abstract);分类 cs.CV

Journal ref ECCV 2024 Workshop Proceedings

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.16314 2024-08-30 cs.CV 70%

ResVG: Enhancing Relation and Semantic Understanding in Multiple Instances for Visual Grounding

Minghang Zheng, Jiahua Zhang, Qingchao Chen, Yuxin Peng, Yang Liu

专题命中 可控生成 :image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments Accepted by ACM MM 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.03209 2024-08-28 cs.CV 70%

IPAdapter-Instruct: Resolving Ambiguity in Image-based Conditioning using Instruct Prompts

Ciara Rowles, Shimon Vainer, Dante De Nigris, Slava Elizarov, Konstantin Kutsy, Simon Donné

专题命中 可控生成 :image generation(abstract);diffusion(abstract);分类 cs.CV

Comments 17 pages, 10 figures, Project page: https://unity-research.github.io/IP-Adapter-Instruct.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.14016 2024-08-27 cs.CV cs.AI 70%

Pixel-Aligned Multi-View Generation with Depth Guided Decoder

Zhenggang Tang, Peiye Zhuang, Chaoyang Wang, Aliaksandr Siarohin, Yash Kant, Alexander Schwing, Sergey Tulyakov, Hsin-Ying Lee

专题命中 可控生成 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.13287 2024-08-27 cs.CV cs.AI cs.LG 70%

Abstract Art Interpretation Using ControlNet

Rishabh Srivastava, Addrish Roy

专题命中 可控生成 :text-to-image(abstract);image synthesis(abstract);分类 cs.CV

Comments 5 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.14568 2024-08-12 cs.CV 70%

UVMap-ID: A Controllable and Personalized UV Map Generative Model

Weijie Wang, Jichao Zhang, Chang Liu, Xia Li, Xingqian Xu, Humphrey Shi, Nicu Sebe, Bruno Lepri

专题命中 可控生成 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

Comments Accepted to ACMMM2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.15446 2024-07-23 cs.CV 70%

Text2Place: Affordance-aware Text Guided Human Placement

Rishubh Parihar, Harsh Gupta, Sachidanand VS, R. Venkatesh Babu

专题命中 可控生成 :text-to-image(abstract);inpainting(abstract);分类 cs.CV

Comments ECCV 2024, Project Page: https://rishubhpar.github.io/Text2Place/

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.15066 2024-07-23 cs.CV 70%

LSReGen: Large-Scale Regional Generator via Backward Guidance Framework

Bowen Zhang, Cheng Yang, Xuanhui Liu

专题命中 可控生成 :image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.10864 2024-07-16 cs.CV cs.AI cs.CL cs.LG 70%

Divide & Bind Your Attention for Improved Generative Semantic Nursing

Yumeng Li, Margret Keuper, Dan Zhang, Anna Khoreva

专题命中 可控生成 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

Comments Accepted at BMVC 2023 as Oral. Code: https://github.com/boschresearch/Divide-and-Bind and project page: https://sites.google.com/view/divide-and-bind

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.18524 2024-06-27 cs.CV 70%

MultiDiff: Consistent Novel View Synthesis from a Single Image

Norman Müller, Katja Schwarz, Barbara Roessle, Lorenzo Porzi, Samuel Rota Bulò, Matthias Nießner, Peter Kontschieder

专题命中 可控生成 :image generation(abstract);diffusion(abstract);分类 cs.CV

Comments Project page: https://sirwyver.github.io/MultiDiff Video: https://youtu.be/zBC4z4qXW_4 - CVPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.17396 2024-06-26 cs.CV 70%

SyncNoise: Geometrically Consistent Noise Prediction for Text-based 3D Scene Editing

Ruihuang Li, Liyi Chen, Zhengqiang Zhang, Varun Jampani, Vishal M. Patel, Lei Zhang

专题命中 可控生成 :image generation(abstract);diffusion(abstract);分类 cs.CV

Comments 16 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.16273 2024-06-25 cs.CV 70%

YouDream: Generating Anatomically Controllable Consistent Text-to-3D Animals

Sandeep Mishra, Oindrila Saha, Alan C. Bovik

专题命中 可控生成 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.13735 2024-06-21 cs.CV cs.LG 70%

StableSemantics: A Synthetic Language-Vision Dataset of Semantic Representations in Naturalistic Images

Rushikesh Zawar, Shaurya Dewan, Andrew F. Luo, Margaret M. Henderson, Michael J. Tarr, Leila Wehbe

专题命中 可控生成 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

Comments Dataset website: https://stablesemantics.github.io/StableSemantics

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.10722 2024-06-18 cs.CV cs.AI cs.LG 70%

GenMM: Geometrically and Temporally Consistent Multimodal Data Generation for Video and LiDAR

Bharat Singh, Viveka Kulharia, Luyu Yang, Avinash Ravichandran, Ambrish Tyagi, Ashish Shrivastava

专题命中 可控生成 :diffusion(abstract);inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.06258 2024-06-12 cs.CV 70%

Tuning-Free Visual Customization via View Iterative Self-Attention Control

Xiaojie Li, Chenghao Gu, Shuzhao Xie, Yunpeng Bai, Weixiang Zhang, Zhi Wang

专题命中 可控生成 :diffusion(abstract);personalized generation(abstract);分类 cs.CV

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.01843 2024-06-05 cs.CV 70%

L-MAGIC: Language Model Assisted Generation of Images with Coherence

Zhipeng Cai, Matthias Mueller, Reiner Birkl, Diana Wofk, Shao-Yen Tseng, JunDa Cheng, Gabriela Ben-Melech Stan, Vasudev Lal, Michael Paulitsch

专题命中 可控生成 :diffusion(abstract);inpainting(abstract);分类 cs.CV

Comments accepted to CVPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.17661 2024-05-29 cs.CV 70%

RefDrop: Controllable Consistency in Image or Video Generation via Reference Feature Guidance

Jiaojiao Fan, Haotian Xue, Qinsheng Zhang, Yongxin Chen

专题命中 可控生成 :image generation(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.09711 2024-05-29 cs.CV 70%

LOVECon: Text-driven Training-Free Long Video Editing with ControlNet

Zhenyi Liao, Zhijie Deng

专题命中 可控生成 :diffusion(abstract);image editing(abstract);分类 cs.CV

Comments AI for Content Creation Workshop @ CVPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.09976 2024-05-17 cs.CV eess.SP 70%

Language-Oriented Semantic Latent Representation for Image Transmission

Giordano Cicchetti, Eleonora Grassucci, Jihong Park, Jinho Choi, Sergio Barbarossa, Danilo Comminiello

专题命中 可控生成 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

Comments Under review at IEEE International Workshop on Machine Learning for Signal Processing (MLSP) 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.06461 2024-05-15 cs.GR 70%

SketchDream: Sketch-based Text-to-3D Generation and Editing

Feng-Lin Liu, Hongbo Fu, Yu-Kun Lai, Lin Gao

专题命中 可控生成 :image generation(abstract);diffusion(abstract);分类 cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.14385 2024-05-07 cs.DC cs.LG cs.MM 70%

Generative AI Beyond LLMs: System Implications of Multi-Modal Generation

Alicia Golden, Samuel Hsia, Fei Sun, Bilge Acun, Basil Hosmer, Yejin Lee, Zachary DeVito, Jeff Johnson, Gu-Yeon Wei, David Brooks, Carole-Jean Wu

专题命中 可控生成 :text-to-image(abstract);diffusion(abstract);分类 cs.MM

Comments Published at 2024 IEEE International Symposium on Performance Analysis of Systems and Software (ISPASS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.18020 2024-04-30 cs.CV 70%

DM-Align: Leveraging the Power of Natural Language Instructions to Make Changes to Images

Maria Mihaela Trusca, Tinne Tuytelaars, Marie-Francine Moens

专题命中 可控生成 :diffusion(abstract);image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.16029 2024-04-25 cs.CV 70%

Editable Image Elements for Controllable Synthesis

Jiteng Mu, Michaël Gharbi, Richard Zhang, Eli Shechtman, Nuno Vasconcelos, Xiaolong Wang, Taesung Park

专题命中 可控生成 :diffusion(abstract);image editing(abstract);分类 cs.CV

Comments Project page: https://jitengmu.github.io/Editable_Image_Elements/

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.18554 2024-04-15 cs.CV 70%

CosalPure: Learning Concept from Group Images for Robust Co-Saliency Detection

Jiayi Zhu, Qing Guo, Felix Juefei-Xu, Yihao Huang, Yang Liu, Geguang Pu

专题命中 可控生成 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

Comments This paper is accepted by CVPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.06780 2024-04-11 cs.CV 70%

Urban Architect: Steerable 3D Urban Scene Generation with Layout Prior

Fan Lu, Kwan-Yee Lin, Yan Xu, Hongsheng Li, Guang Chen, Changjun Jiang

专题命中 可控生成 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

Comments Project page: https://urbanarchitect.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.05006 2024-04-08 eess.IV cs.CV 70%

Synthesis of Annotated Colorectal Cancer Tissue Images from Gland Layout

Srijay Deshpande, Fayyaz Minhas, Nasir Rajpoot

专题命中 可控生成 :image generation(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.11281 2024-04-02 cs.CV 70%

Language-driven Object Fusion into Neural Radiance Fields with Pose-Conditioned Dataset Updates

Ka Chun Shum, Jaeyeon Kim, Binh-Son Hua, Duc Thanh Nguyen, Sai-Kit Yeung

专题命中 可控生成 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

Comments CVPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.04784 2024-03-26 cs.CV 70%

Reality's Canvas, Language's Brush: Crafting 3D Avatars from Monocular Video

Yuchen Rao, Eduardo Perez Pellitero, Benjamin Busam, Yiren Zhou, Jifei Song

专题命中 可控生成 :diffusion(abstract);image synthesis(abstract);分类 cs.CV

Comments Video link: https://youtu.be/Oz83z1es2J4

详情

展开后加载摘要…

URL PDF HTML 收藏