arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 4215 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 4215 篇

2311.14521 2023-12-21 cs.CV 57%

GaussianEditor: Swift and Controllable 3D Editing with Gaussian Splatting

Yiwen Chen, Zilong Chen, Chi Zhang, Feng Wang, Xiaofeng Yang, Yikai Wang, Zhongang Cai, Lei Yang, Huaping Liu, Guosheng Lin

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Project Page: https://buaacyw.github.io/gaussian-editor/ Code: https://github.com/buaacyw/GaussianEditor

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.02087 2023-12-06 cs.CV 57%

VideoSwap: Customized Video Subject Swapping with Interactive Semantic Point Correspondence

Yuchao Gu, Yipin Zhou, Bichen Wu, Licheng Yu, Jia-Wei Liu, Rui Zhao, Jay Zhangjie Wu, David Junhao Zhang, Mike Zheng Shou, Kevin Tang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Project page at https://videoswap.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.12886 2023-12-06 cs.CV 57%

AnimateAnything: Fine-Grained Open Domain Image Animation with Motion Guidance

Zuozhuo Dai, Zhenghao Zhang, Yao Yao, Bingxue Qiu, Siyu Zhu, Long Qin, Weizhi Wang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.08956 2023-12-06 cs.CV 57%

PG-VTON: A Novel Image-Based Virtual Try-On Method via Progressive Inference Paradigm

Naiyu Fang, Lemiao Qiu, Shuyou Zhang, Zili Wang, Kerui Hu

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.03373 2023-11-30 cs.CV 57%

Training-Free Layout Control with Cross-Attention Guidance

Minghao Chen, Iro Laina, Andrea Vedaldi

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments WACV 2024, Project Page: https://silent-chen.github.io/layout-guidance/

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.15551 2023-11-28 cs.CV cs.AI cs.CR cs.LG eess.IV 57%

Instruct2Attack: Language-Guided Semantic Adversarial Attacks

Jiang Liu, Chen Wei, Yuxiang Guo, Heng Yu, Alan Yuille, Soheil Feizi, Chun Pong Lau, Rama Chellappa

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments under submission, code coming soon

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.12454 2023-11-28 cs.SD cs.AI cs.MM eess.AS 57%

HierSpeech++: Bridging the Gap between Semantic and Acoustic Representation of Speech by Hierarchical Variational Inference for Zero-shot Speech Synthesis

Sang-Hoon Lee, Ha-Yeong Choi, Seung-Bin Kim, Seong-Whan Lee

专题命中 可控生成 :diffusion(abstract);分类 cs.MM

Comments 16 pages, 9 figures, 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.13655 2023-11-27 cs.CV 57%

GAN-Avatar: Controllable Personalized GAN-based Human Head Avatar

Berna Kabadayi, Wojciech Zielonka, Bharat Lal Bhatnagar, Gerard Pons-Moll, Justus Thies

专题命中 可控生成 :image synthesis(abstract);分类 cs.CV

Comments Website: https://ganavatar.github.io/ , Video: https://www.youtube.com/watch?v=uAi5IVrzzZY&ab_channel=JustusThies , Accepted to 3DV2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.12043 2023-11-22 cs.CV cs.AI 57%

Efficient Domain Adaptation via Generative Prior for 3D Infant Pose Estimation

Zhuoran Zhou, Zhongyu Jiang, Wenhao Chai, Cheng-Yen Yang, Lei Li, Jenq-Neng Hwang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments WACVW 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.11697 2023-11-21 cs.CV 57%

Cut-and-Paste: Subject-Driven Video Editing with Attention Control

Zhichao Zuo, Zhao Zhang, Yan Luo, Yang Zhao, Haijun Zhang, Yi Yang, Meng Wang

专题命中 可控生成 :image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.02881 2023-11-14 cs.CV 57%

Probabilistic and Semantic Descriptions of Image Manifolds and Their Applications

Peter Tu, Zhaoyuan Yang, Richard Hartley, Zhiwei Xu, Jing Zhang, Yiwei Fu, Dylan Campbell, Jaskirat Singh, Tianyu Wang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments 26 pages, 17 figures, 1 table, accepted to Frontiers in Computer Science, 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.03866 2023-11-08 cs.CV 57%

SCONE-GAN: Semantic Contrastive learning-based Generative Adversarial Network for an end-to-end image translation

Iman Abbasnejad, Fabio Zambetta, Flora Salim, Timothy Wiley, Jeffrey Chan, Russell Gallagher, Ehsan Abbasnejad

专题命中 可控生成 :image generation(abstract);分类 cs.CV

Comments 9 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.16858 2023-11-08 cs.CV 57%

4D-Editor: Interactive Object-level Editing in Dynamic Neural Radiance Fields via Semantic Distillation

Dadong Jiang, Zhihui Ke, Xiaobo Zhou, Xidong Shi

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

Comments Project page: https://patrickddj.github.io/4D-Editor

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.01573 2023-11-06 cs.CV cs.AI cs.CY cs.LG 57%

Improving Fairness using Vision-Language Driven Image Augmentation

Moreno D'Incà, Christos Tzelepis, Ioannis Patras, Nicu Sebe

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted for publication in WACV 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.00425 2023-11-02 cs.CV cs.AI 57%

Neural Implicit Field Editing Considering Object-environment Interaction

Zhihong Zeng, Zongji Wang, Yuanben Zhang, Weinan Cai, Zehao Cao, Lili Zhang, Yan Guo, Yanhong Zhang, Junyi Liu

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.19024 2023-10-31 cs.CV 57%

FPGAN-Control: A Controllable Fingerprint Generator for Training with Synthetic Data

Alon Shoshan, Nadav Bhonker, Emanuel Ben Baruch, Ori Nizan, Igor Kviatkovsky, Joshua Engelsma, Manoj Aggarwal, Gerard Medioni

专题命中 可控生成 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.12775 2023-10-25 cs.MM 57%

Semantic Change Driven Generative Semantic Communication Framework

Wanting Yang, Zehui Xiong, Hongyang Du, Yanli Yuan, Tony Q. S. Quek

专题命中 可控生成 :diffusion(abstract);分类 cs.MM

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.09285 2023-10-16 cs.CV 57%

SAIR: Learning Semantic-aware Implicit Representation

Canyu Zhang, Xiaoguang Li, Qing Guo, Song Wang

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.11932 2023-10-06 cs.CV 57%

RIC: Rotate-Inpaint-Complete for Generalizable Scene Reconstruction

Isaac Kasahara, Shubham Agrawal, Selim Engin, Nikhil Chavan-Dafle, Shuran Song, Volkan Isler

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.10503 2023-10-02 cs.CV 57%

OR-NeRF: Object Removing from 3D Scenes Guided by Multiview Segmentation with Neural Radiance Fields

Youtan Yin, Zhoujie Fu, Fan Yang, Guosheng Lin

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

Comments project site: https://ornerf.github.io/ (codes available)

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.18135 2023-09-29 cs.CV 57%

Alignment-free HDR Deghosting with Semantics Consistent Transformer

Steven Tel, Zongwei Wu, Yulun Zhang, Barthélémy Heyrman, Cédric Demonceaux, Radu Timofte, Dominique Ginhac

专题命中 可控生成 :image generation(abstract);分类 cs.CV

Comments Accepted to ICCV 2023. Version 2: Corrections are made to the conference proceedings to address issues with the production of our benchmark input. We have now updated Table 3 and Figure 6 to reflect these changes

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.13563 2023-09-28 cs.CV cs.AI 57%

Noise-aware Learning from Web-crawled Image-Text Data for Image Captioning

Wooyoung Kang, Jonghwan Mun, Sungjun Lee, Byungseok Roh

专题命中 可控生成 :text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.11684 2023-09-27 cs.CV 57%

Scene-aware Egocentric 3D Human Pose Estimation

Jian Wang, Lingjie Liu, Weipeng Xu, Kripasindhu Sarkar, Diogo Luvizon, Christian Theobalt

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.11667 2023-09-22 cs.CV 57%

Understanding Pose and Appearance Disentanglement in 3D Human Pose Estimation

Krishna Kanth Nakka, Mathieu Salzmann

专题命中 可控生成 :image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.09294 2023-09-19 cs.CV 57%

LivelySpeaker: Towards Semantic-Aware Co-Speech Gesture Generation

Yihao Zhi, Xiaodong Cun, Xuelin Chen, Xi Shen, Wen Guo, Shaoli Huang, Shenghua Gao

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted by ICCV 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.06024 2023-09-19 cs.CV cs.AI 57%

Probabilistic Human Mesh Recovery in 3D Scenes from Egocentric Views

Siwei Zhang, Qianli Ma, Yan Zhang, Sadegh Aliakbarian, Darren Cosker, Siyu Tang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Camera ready version for ICCV 2023, appendix included

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.06714 2023-09-14 cs.CV 57%

MPI-Flow: Learning Realistic Optical Flow with Multiplane Images

Yingping Liang, Jiaming Liu, Debing Zhang, Ying Fu

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

Comments Accepted to ICCV2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.05095 2023-09-12 cs.CV 57%

MaskRenderer: 3D-Infused Multi-Mask Realistic Face Reenactment

Tina Behrouzi, Atefeh Shahroudnejad, Payam Mousavi

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.04814 2023-09-12 cs.CV 57%

Speech2Lip: High-fidelity Speech to Lip Generation by Learning from a Short Video

Xiuzhe Wu, Pengfei Hu, Yang Wu, Xiaoyang Lyu, Yan-Pei Cao, Ying Shan, Wenming Yang, Zhongqian Sun, Xiaojuan Qi

专题命中 可控生成 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.04147 2023-09-11 cs.CV 57%

Robot Localization and Mapping Final Report -- Sequential Adversarial Learning for Self-Supervised Deep Visual Odometry

Akankshya Kar, Sajal Maheshwari, Shamit Lal, Vinay Sameer Raja Kad

专题命中 可控生成 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏