arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 4210 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 4210 篇

2403.15059 2024-03-25 cs.CV cs.AI 70%

MM-Diff: High-Fidelity Image Personalization via Multi-Modal Condition Integration

Zhichao Wei, Qingkun Su, Long Qin, Weizhi Wang

专题命中 可控生成 :image generation(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.00420 2024-03-20 cs.CV cs.AI 70%

SynCDR : Training Cross Domain Retrieval Models with Synthetic Data

Samarth Mishra, Carlos D. Castillo, Hongcheng Wang, Kate Saenko, Venkatesh Saligrama

专题命中 可控生成 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

Comments Pre-print

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.12396 2024-03-20 cs.CV cs.RO 70%

OV9D: Open-Vocabulary Category-Level 9D Object Pose and Size Estimation

Junhao Cai, Yisheng He, Weihao Yuan, Siyu Zhu, Zilong Dong, Liefeng Bo, Qifeng Chen

专题命中 可控生成 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.12011 2024-03-19 cs.CV 70%

HOIDiffusion: Generating Realistic 3D Hand-Object Interaction Data

Mengqi Zhang, Yang Fu, Zheng Ding, Sifei Liu, Zhuowen Tu, Xiaolong Wang

专题命中 可控生成 :diffusion(abstract);image synthesis(abstract);分类 cs.CV

Comments Project page: https://mq-zhang1.github.io/HOIDiffusion

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.08294 2024-03-14 cs.CV 70%

Attack Deterministic Conditional Image Generative Models for Diverse and Controllable Generation

Tianyi Chu, Wei Xing, Jiafu Chen, Zhizhong Wang, Jiakai Sun, Lei Zhao, Haibo Chen, Huaizhong Lin

专题命中 可控生成 :image generation(abstract);inpainting(abstract);分类 cs.CV

Comments 9 pages, 7 figures, accepted by AAAI24

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.06439 2024-03-13 cs.CV 70%

DreamControl: Control-Based Text-to-3D Generation with 3D Self-Prior

Tianyu Huang, Yihan Zeng, Zhilu Zhang, Wan Xu, Hang Xu, Songcen Xu, Rynson W. H. Lau, Wangmeng Zuo

专题命中 可控生成 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

Comments Accepted by CVPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.11074 2024-03-13 cs.CV 70%

DepthFake: a depth-based strategy for detecting Deepfake videos

Luca Maiano, Lorenzo Papa, Ketbjano Vocaj, Irene Amerini

专题命中 可控生成 :image generation(abstract);diffusion(abstract);分类 cs.CV

Comments 2022 ICPR Workshop on Artificial Intelligence for Multimedia Forensics and Disinformation Detection

Journal ref Springer 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.00808 2024-02-05 cs.CV 70%

Completing Visual Objects via Bridging Generation and Segmentation

Xiang Li, Yinpeng Chen, Chung-Ching Lin, Hao Chen, Kai Hu, Rita Singh, Bhiksha Raj, Lijuan Wang, Zicheng Liu

专题命中 可控生成 :image generation(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.07665 2024-01-04 cs.CV 70%

Inversion-by-Inversion: Exemplar-based Sketch-to-Photo Synthesis via Stochastic Differential Equations without Training

Ximing Xing, Chuang Wang, Haitao Zhou, Zhihao Hu, Chongxuan Li, Dong Xu, Qian Yu

专题命中 可控生成 :image generation(abstract);diffusion(abstract);分类 cs.CV

Comments 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.01186 2024-01-04 cs.CV 70%

Follow Your Pose: Pose-Guided Text-to-Video Generation using Pose-Free Videos

Yue Ma, Yingqing He, Xiaodong Cun, Xintao Wang, Siran Chen, Ying Shan, Xiu Li, Qifeng Chen

专题命中 可控生成 :image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments Project page: https://follow-your-pose.github.io/; Github repository: https://github.com/mayuelala/FollowYourPose

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.13271 2023-12-29 cs.CV 70%

Repaint123: Fast and High-quality One Image to 3D Generation with Progressive Controllable 2D Repainting

Junwu Zhang, Zhenyu Tang, Yatian Pang, Xinhua Cheng, Peng Jin, Yida Wei, Munan Ning, Li Yuan

专题命中 可控生成 :image generation(abstract);diffusion(abstract);分类 cs.CV

Comments Project page: https://pku-yuangroup.github.io/repaint123/

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.02928 2023-12-06 cs.CV 70%

LivePhoto: Real Image Animation with Text-guided Motion Control

Xi Chen, Zhiheng Liu, Mengting Chen, Yutong Feng, Yu Liu, Yujun Shen, Hengshuang Zhao

专题命中 可控生成 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

Comments Project page: https://xavierchen34.github.io/LivePhoto-Page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.17098 2023-11-29 cs.CV 70%

ControlVideo: Conditional Control for One-shot Text-driven Video Editing and Beyond

Min Zhao, Rongzhen Wang, Fan Bao, Chongxuan Li, Jun Zhu

专题命中 可控生成 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.16122 2023-11-29 cs.CV cs.AI cs.LG 70%

Semantic Generative Augmentations for Few-Shot Counting

Perla Doubinsky, Nicolas Audebert, Michel Crucianu, Hervé Le Borgne

专题命中 可控生成 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2209.08256 2023-11-22 cs.CV 70%

Can segmentation models be trained with fully synthetically generated data?

Virginia Fernandez, Walter Hugo Lopez Pinaya, Pedro Borges, Petru-Daniel Tudosiu, Mark S Graham, Tom Vercauteren, M Jorge Cardoso

专题命中 可控生成 :diffusion(abstract);image synthesis(abstract);分类 cs.CV

Comments 12 pages, 2 (+2 App.) figures, 3 tables. Accepted at Simulation and Synthesis in Medical Imaging workshop (MICCAI 2022)

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.11243 2023-11-21 cs.CV 70%

AutoStory: Generating Diverse Storytelling Images with Minimal Human Effort

Wen Wang, Canyu Zhao, Hao Chen, Zhekai Chen, Kecheng Zheng, Chunhua Shen

专题命中 可控生成 :image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments 19 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.18259 2023-11-14 cs.CV 70%

GlyphControl: Glyph Conditional Control for Visual Text Generation

Yukang Yang, Dongnan Gui, Yuhui Yuan, Weicong Liang, Haisong Ding, Han Hu, Kai Chen

专题命中 可控生成 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

Comments Accepted by NeurIPS 2023. The codes have been released at https://github.com/AIGText/GlyphControl-release

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.04783 2023-11-09 cs.CV 70%

VioLA: Aligning Videos to 2D LiDAR Scans

Jun-Jee Chao, Selim Engin, Nikhil Chavan-Dafle, Bhoram Lee, Volkan Isler

专题命中 可控生成 :text-to-image(abstract);inpainting(abstract);分类 cs.CV

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.13251 2023-10-31 cs.CV 70%

CGOF++: Controllable 3D Face Synthesis with Conditional Generative Occupancy Fields

Keqiang Sun, Shangzhe Wu, Ning Zhang, Zhaoyang Huang, Quan Wang, Hongsheng Li

专题命中 可控生成 :image generation(abstract);image synthesis(abstract);分类 cs.CV

Comments Accepted to IEEE Transactions on Pattern Analysis and Machine Intelligence (TPAMI). This article is an extension of the NeurIPS'22 paper arXiv:2206.08361

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.10644 2023-10-17 cs.CV 70%

TOSS:High-quality Text-guided Novel View Synthesis from a Single Image

Yukai Shi, Jianan Wang, He Cao, Boshi Tang, Xianbiao Qi, Tianyu Yang, Yukun Huang, Shilong Liu, Lei Zhang, Heung-Yeung Shum

专题命中 可控生成 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.17154 2023-06-30 cs.CV 70%

Generate Anything Anywhere in Any Scene

Yuheng Li, Haotian Liu, Yangming Wen, Yong Jae Lee

专题命中 可控生成 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.06110 2023-06-13 cs.LG cs.CE cs.CV 70%

Surrogate Modeling of Car Drag Coefficient with Depth and Normal Renderings

Binyang Song, Chenyang Yuan, Frank Permenter, Nikos Arechiga, Faez Ahmed

专题命中 可控生成 :image generation(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.19195 2023-05-31 cs.CV cs.AI cs.CL cs.LG 70%

PanoGen: Text-Conditioned Panoramic Environment Generation for Vision-and-Language Navigation

Jialu Li, Mohit Bansal

专题命中 可控生成 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

Comments Project Webpage: https://pano-gen.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.13077 2023-05-23 cs.CV 70%

ControlVideo: Training-free Controllable Text-to-Video Generation

Yabo Zhang, Yuxiang Wei, Dongsheng Jiang, Xiaopeng Zhang, Wangmeng Zuo, Qi Tian

专题命中 可控生成 :image generation(abstract);diffusion(abstract);分类 cs.CV

Comments Code is available at https://github.com/YBYBZhang/ControlVideo

详情

展开后加载摘要…

URL PDF HTML 收藏
2205.10636 2023-03-27 cs.CV 70%

AutoLink: Self-supervised Learning of Human Skeletons and Object Outlines by Linking Keypoints

Xingzhe He, Bastian Wandt, Helge Rhodin

专题命中 可控生成 :image generation(abstract);inpainting(abstract);分类 cs.CV

Comments NeurIPS 2022

Journal ref Advances in Neural Information Processing Systems 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2301.05315 2023-01-16 cs.CV 70%

GH-Feat: Learning Versatile Generative Hierarchical Features from GANs

Yinghao Xu, Yujun Shen, Jiapeng Zhu, Ceyuan Yang, Bolei Zhou

专题命中 可控生成 :image editing(abstract);image synthesis(abstract);分类 cs.CV

Comments Accepted by TPAMI 2022. arXiv admin note: text overlap with arXiv:2007.10379

详情

展开后加载摘要…

URL PDF HTML 收藏
2206.08361 2022-12-13 cs.CV 70%

Controllable 3D Face Synthesis with Conditional Generative Occupancy Fields

Keqiang Sun, Shangzhe Wu, Zhaoyang Huang, Ning Zhang, Quan Wang, HongSheng Li

专题命中 可控生成 :image generation(abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2201.00308 2022-11-30 cs.LG cs.CV 70%

DiffuseVAE: Efficient, Controllable and High-Fidelity Generation from Low-Dimensional Latents

Kushagra Pandey, Avideep Mukherjee, Piyush Rai, Abhishek Kumar

专题命中 可控生成 :diffusion(abstract);image synthesis(abstract);分类 cs.CV

Comments 12 pages main content. Camera-Ready version accepted at Transactions on Machine Learning Research

详情

展开后加载摘要…

URL PDF HTML 收藏
2103.07751 2022-10-07 cs.CV 70%

Unsupervised Image Transformation Learning via Generative Adversarial Networks

Kaiwen Zha, Yujun Shen, Bolei Zhou

专题命中 可控生成 :image editing(abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.04705 2022-03-10 cs.CV 70%

FlexIT: Towards Flexible Semantic Image Translation

Guillaume Couairon, Asya Grechka, Jakob Verbeek, Holger Schwenk, Matthieu Cord

专题命中 可控生成 :image editing(abstract);image synthesis(abstract);分类 cs.CV

Comments accepted at CVPR 2022

详情

展开后加载摘要…

URL PDF HTML 收藏