arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 4215 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 4215 篇

2212.01381 2023-09-06 cs.CV 57%

LatentSwap3D: Semantic Edits on 3D Image GANs

Enis Simsar, Alessio Tonioni, Evin Pınar Örnek, Federico Tombari

专题命中 可控生成 :image editing(abstract);分类 cs.CV

Comments The paper has been accepted by ICCV'23 AI3DCC

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.16758 2023-09-01 cs.CV 57%

Towards High-Fidelity Text-Guided 3D Face Generation and Manipulation Using only Images

Cuican Yu, Guansong Lu, Yihan Zeng, Jian Sun, Xiaodan Liang, Huibin Li, Zongben Xu, Songcen Xu, Wei Zhang, Hang Xu

专题命中 可控生成 :image generation(abstract);分类 cs.CV

Comments accepted by ICCV 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.15142 2023-08-30 cs.CV cs.AI q-bio.NC 57%

A Multimodal Visual Encoding Model Aided by Introducing Verbal Semantic Information

Shuxiao Ma, Linyuan Wang, Bin Yan

专题命中 可控生成 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.14191 2023-08-29 cs.CV 57%

SketchDreamer: Interactive Text-Augmented Creative Sketch Ideation

Zhiyu Qu, Tao Xiang, Yi-Zhe Song

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments BMVC 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.13042 2023-08-28 cs.CV cs.HC 57%

Enhancing Perception and Immersion in Pre-Captured Environments through Learning-Based Eye Height Adaptation

Qi Feng, Hubert P. H. Shum, Shigeo Morishima

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

Comments 10 pages, 13 figures, 3 tables, submitted to ISMAR 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.12965 2023-08-25 cs.CV 57%

POCO: 3D Pose and Shape Estimation with Confidence

Sai Kumar Dwivedi, Cordelia Schmid, Hongwei Yi, Michael J. Black, Dimitrios Tzionas

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.10705 2023-08-22 cs.CV cs.AI 57%

Unsupervised 3D Pose Estimation with Non-Rigid Structure-from-Motion Modeling

Haorui Ji, Hui Deng, Yuchao Dai, Hongdong Li

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.10648 2023-08-22 cs.CV cs.AI 57%

EVE: Efficient zero-shot text-based Video Editing with Depth Map Guidance and Temporal Consistency Constraints

Yutao Chen, Xingning Dong, Tian Gan, Chunluan Zhou, Ming Yang, Qingpei Guo

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.10257 2023-08-22 cs.CV 57%

Make-It-4D: Synthesizing a Consistent Long-Term Dynamic Scene Video from a Single Image

Liao Shen, Xingyi Li, Huiqiang Sun, Juewen Peng, Ke Xian, Zhiguo Cao, Guosheng Lin

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments accepted by ACM MM'23

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.09910 2023-08-22 cs.CV 57%

Physics-Guided Human Motion Capture with Pose Probability Modeling

Jingyi Ju, Buzhen Huang, Chen Zhu, Zhihao Li, Yangang Wang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments accepted by IJCAI2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.09894 2023-08-22 cs.CV 57%

Semantic-Human: Neural Rendering of Humans from Monocular Video with Human Parsing

Jie Zhang, Pengcheng Shi, Zaiwang Gu, Yiyang Zhou, Zhi Wang

专题命中 可控生成 :image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.17606 2023-08-22 cs.CV 57%

AvatarCraft: Transforming Text into Neural Human Avatars with Parameterized Shape and Pose Control

Ruixiang Jiang, Can Wang, Jingbo Zhang, Menglei Chai, Mingming He, Dongdong Chen, Jing Liao

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments ICCV 2023 Camera Ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.08089 2023-08-17 cs.CV 57%

DragNUWA: Fine-grained Control in Video Generation by Integrating Text, Image, and Trajectory

Shengming Yin, Chenfei Wu, Jian Liang, Jie Shi, Houqiang Li, Gong Ming, Nan Duan

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2107.13087 2023-08-16 cs.CV 57%

DCL: Differential Contrastive Learning for Geometry-Aware Depth Synthesis

Yuefan Shen, Yanchao Yang, Youyi Zheng, C. Karen Liu, Leonidas Guibas

专题命中 可控生成 :image synthesis(abstract);分类 cs.CV

Comments Accepted by International Conference on Robotics and Automation (ICRA) 2022 and RA-L 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.03610 2023-08-08 cs.CV 57%

AvatarVerse: High-quality & Stable 3D Avatar Creation from Text and Pose

Huichao Zhang, Bowen Chen, Hao Yang, Liao Qu, Xu Wang, Li Chen, Chao Long, Feida Zhu, Kang Du, Min Zheng

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.14748 2023-07-28 cs.CV cs.LG eess.IV 57%

Semantic Image Completion and Enhancement using GANs

Priyansh Saxena, Raahat Gupta, Akshat Maheshwari, Saumil Maheshwari

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

Comments This work is part of 'High-Performance Vision Intelligence'; Part of the Studies in Computational Intelligence book series (SCI, volume 913) and can be accessed at: https://link.springer.com/chapter/10.1007/978-981-15-6844-2_11. arXiv admin note: substantial text overlap with arXiv:1911.02222

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.13908 2023-07-27 cs.CV 57%

Points-to-3D: Bridging the Gap between Sparse Points and Shape-Controllable Text-to-3D Generation

Chaohui Yu, Qiang Zhou, Jingliang Li, Zhe Zhang, Zhibin Wang, Fan Wang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted by ACMMM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.13240 2023-07-26 cs.CV 57%

Fashion Matrix: Editing Photos by Just Talking

Zheng Chong, Xujie Zhang, Fuwei Zhao, Zhenyu Xie, Xiaodan Liang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments 13 pages, 5 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.15932 2023-07-19 cs.CV 57%

Unify, Align and Refine: Multi-Level Semantic Alignment for Radiology Report Generation

Yaowei Li, Bang Yang, Xuxin Cheng, Zhihong Zhu, Hongxiang Li, Yuexian Zou

专题命中 可控生成 :text-to-image(abstract);分类 cs.CV

Comments 1)Reassessment of author contributions. 2)Try to solve the problem that Google Scholar does not display the all authors

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.09532 2023-07-11 cs.RO cs.GR 57%

Hierarchical Planning and Control for Box Loco-Manipulation

Zhaoming Xie, Jonathan Tseng, Sebastian Starke, Michiel van de Panne, C. Karen Liu

专题命中 可控生成 :diffusion(abstract);分类 cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.01944 2023-07-06 cs.LG cs.CV cs.IT math.IT 57%

Text + Sketch: Image Compression at Ultra Low Rates

Eric Lei, Yiğit Berkay Uslu, Hamed Hassani, Shirin Saeedi Bidokhti

专题命中 可控生成 :text-to-image(abstract);分类 cs.CV

Comments ICML 2023 Neural Compression Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.04106 2023-07-06 eess.IV cs.CV 57%

MedGen3D: A Deep Generative Framework for Paired 3D Image and Mask Generation

Kun Han, Yifeng Xiong, Chenyu You, Pooya Khosravi, Shanlin Sun, Xiangyi Yan, James Duncan, Xiaohui Xie

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted by MICCAI 2023. Project Page: https://krishan999.github.io/MedGen3D/

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.10764 2023-06-21 cs.CV 57%

OpenShape: Scaling Up 3D Shape Representation Towards Open-World Understanding

Minghua Liu, Ruoxi Shi, Kaiming Kuang, Yinhao Zhu, Xuanlin Li, Shizhong Han, Hong Cai, Fatih Porikli, Hao Su

专题命中 可控生成 :image generation(abstract);分类 cs.CV

Comments Project Website: https://colin97.github.io/OpenShape/

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.09864 2023-06-19 cs.CV 57%

AvatarBooth: High-Quality and Customizable 3D Human Avatar Generation

Yifei Zeng, Yuanxun Lu, Xinya Ji, Yao Yao, Hao Zhu, Xun Cao

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Project website at https://zeng-yifei.github.io/avatarbooth_page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.09274 2023-06-16 cs.CV eess.IV 57%

Conditional Human Sketch Synthesis with Explicit Abstraction Control

Dar-Yen Chen

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Code is available at https://github.com/ChenDarYen/Conditional-Human-Sketch-Synthesis-with-Explicit-Abstraction-Control

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.04619 2023-06-08 cs.CV 57%

ARTIC3D: Learning Robust Articulated 3D Shapes from Noisy Web Image Collections

Chun-Han Yao, Amit Raj, Wei-Chih Hung, Yuanzhen Li, Michael Rubinstein, Ming-Hsuan Yang, Varun Jampani

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Project page: https://chhankyao.github.io/artic3d/

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.02018 2023-06-07 cs.CV 57%

VideoComposer: Compositional Video Synthesis with Motion Controllability

Xiang Wang, Hangjie Yuan, Shiwei Zhang, Dayou Chen, Jiuniu Wang, Yingya Zhang, Yujun Shen, Deli Zhao, Jingren Zhou

专题命中 可控生成 :image synthesis(abstract);分类 cs.CV

Comments The first four authors contributed equally. Project page: https://videocomposer.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.01148 2023-06-05 cs.CV cs.LG 57%

Addressing Discrepancies in Semantic and Visual Alignment in Neural Networks

Natalie Abreu, Nathan Vaska, Victoria Helus

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.19962 2023-06-01 cs.CV 57%

GANDiffFace: Controllable Generation of Synthetic Datasets for Face Recognition with Realistic Variations

Pietro Melzi, Christian Rathgeb, Ruben Tolosana, Ruben Vera-Rodriguez, Dominik Lawatsch, Florian Domin, Maxim Schaubert

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments 8 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.18769 2023-05-31 cs.CV cs.LG 57%

DualVAE: Controlling Colours of Generated and Real Images

Keerth Rathakumar, David Liebowitz, Christian Walder, Kristen Moore, Salil S. Kanhere

专题命中 可控生成 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏