arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 4211 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 4211 篇

2409.07179 2024-09-12 cs.CV 57%

Phy124: Fast Physics-Driven 4D Content Generation from a Single Image

Jiajing Lin, Zhenzhong Wang, Yongjie Hou, Yuzhou Tang, Min Jiang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.06189 2024-09-12 cs.CV 57%

MyGo: Consistent and Controllable Multi-View Driving Video Generation with Camera Control

Yining Yao, Xi Guo, Chenjing Ding, Wei Wu

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Project Page: https://metadrivescape.github.io/papers_project/MyGo/page.html

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.13206 2024-09-06 cs.CV cs.AI 57%

Depth-guided NeRF Training via Earth Mover's Distance

Anita Rau, Josiah Aklilu, F. Christopher Holsinger, Serena Yeung-Levy

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted to ECCV 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.01595 2024-09-04 cs.CV 57%

DiVE: DiT-based Video Generation with Enhanced Control

Junpeng Jiang, Gangyi Hong, Lijun Zhou, Enhui Ma, Hengtong Hu, Xia Zhou, Jie Xiang, Fan Liu, Kaicheng Yu, Haiyang Sun, Kun Zhan, Peng Jia, Miao Zhang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.04811 2024-09-04 cs.CV 57%

Image-Based Virtual Try-On: A Survey

Dan Song, Xuanpu Zhang, Juan Zhou, Weizhi Nie, Ruofeng Tong, Mohan Kankanhalli, An-An Liu

专题命中 可控生成 :image generation(abstract);分类 cs.CV

Comments 30 pages, 20 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.14342 2024-08-30 cs.CV physics.med-ph 57%

Dual-Domain CLIP-Assisted Residual Optimization Perception Model for Metal Artifact Reduction

Xinrui Zhang, Ailong Cai, Shaoyu Wang, Linyuan Wang, Zhizhong Zheng, Lei Li, Bin Yan

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments 14 pages, 18 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.15995 2024-08-29 cs.CV 57%

TEDRA: Text-based Editing of Dynamic and Photoreal Actors

Basavaraj Sunagad, Heming Zhu, Mohit Mendiratta, Adam Kortylewski, Christian Theobalt, Marc Habermann

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments For project page, see this https://vcai.mpi-inf.mpg.de/projects/Tedra

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.12340 2024-08-28 cs.CV 57%

VTON-HandFit: Virtual Try-on for Arbitrary Hand Pose Guided by Hand Priors Embedding

Yujie Liang, Xiaobin Hu, Boyuan Jiang, Donghao Luo, Kai WU, Wenhui Han, Taisong Jin, Chengjie Wang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments The project page is \url{https://vton-handfit.github.io}

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.21136 2024-08-27 cs.CV 57%

MotionCraft: Crafting Whole-Body Motion with Plug-and-Play Multimodal Controls

Yuxuan Bian, Ailing Zeng, Xuan Ju, Xian Liu, Zhaoyang Zhang, Wei Liu, Qiang Xu

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.02034 2024-08-22 cs.CV 57%

TrAME: Trajectory-Anchored Multi-View Editing for Text-Guided 3D Gaussian Splatting Manipulation

Chaofan Luo, Donglin Di, Xun Yang, Yongjia Ma, Zhou Xue, Chen Wei, Yebin Liu

专题命中 可控生成 :text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.06168 2024-08-22 cs.CV cs.AI 57%

DiffuMatting: Synthesizing Arbitrary Objects with Matting-level Annotation

Xiaobin Hu, Xu Peng, Donghao Luo, Xiaozhong Ji, Jinlong Peng, Zhengkai Jiang, Jiangning Zhang, Taisong Jin, Chengjie Wang, Rongrong Ji

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments This paper was accepted by ECCV 2024, and the project page is accessible at: \url{https://diffumatting.github.io}

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.09240 2024-08-20 cs.CV 57%

RepControlNet: ControlNet Reparameterization

Zhaoli Deng, Kaibin Zhou, Fanyi Wang, Zhenpeng Mi

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.08556 2024-08-16 cs.CV cs.AI 57%

SM4Depth: Seamless Monocular Metric Depth Estimation across Multiple Cameras and Scenes by One Model

Yihao Liu, Feng Xue, Anlong Ming, Mingshuai Zhao, Huadong Ma, Nicu Sebe

专题命中 可控生成 :image editing(abstract);分类 cs.CV

Comments Accepted by ACM MultiMedia 24, Project Page: xuefeng-cvr.github.io/SM4Depth

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.08651 2024-08-15 cs.CV 57%

HAIFIT: Human-to-AI Fashion Image Translation

Jianan Jiang, Xinglin Li, Weiren Yu, Di Wu

专题命中 可控生成 :image generation(abstract);分类 cs.CV

Comments 10 pages,8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.04865 2024-08-12 cs.SD cs.MM eess.AS 57%

TEAdapter: Supply abundant guidance for controllable text-to-music generation

Jialing Zou, Jiahao Mei, Xudong Nan, Jinghua Li, Daoguo Dong, Liang He

专题命中 可控生成 :diffusion(abstract);分类 cs.MM

Comments Accepted by ICME'24: IEEE International Conference on Multimedia and Expo

Journal ref 2024 IEEE International Conference on Multimedia and Expo (ICME 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.16499 2024-08-07 cs.CV 57%

InceptionHuman: Controllable Prompt-to-NeRF for Photorealistic 3D Human Generation

Shiu-hong Kao, Xinhang Liu, Yu-Wing Tai, Chi-Keung Tang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.02100 2024-08-06 cs.CV 57%

View-consistent Object Removal in Radiance Fields

Yiren Lu, Jing Ma, Yu Yin

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

Comments Accepted to ACM Multimedia (MM) 2024. Project website is accessible at https://vulab-ai.github.io/View-consistent_Object_Removal_in_Radiance_Fields

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.01678 2024-08-06 cs.CV 57%

iControl3D: An Interactive System for Controllable 3D Scene Generation

Xingyi Li, Yizheng Wu, Jun Cen, Juewen Peng, Kewei Wang, Ke Xian, Zhe Wang, Zhiguo Cao, Guosheng Lin

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted by ACM MM 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.01664 2024-08-06 cs.CV cs.AI 57%

SAT3D: Image-driven Semantic Attribute Transfer in 3D

Zhijun Zhai, Zengmao Wang, Xiaoxiao Long, Kaixuan Zhou, Bo Du

专题命中 可控生成 :image editing(abstract);分类 cs.CV

Journal ref In Proceedings of the 32nd ACM International Conference on Multimedia, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.01553 2024-08-06 cs.CV eess.IV 57%

Multi-task SAR Image Processing via GAN-based Unsupervised Manipulation

Xuran Hu, Mingzhe Zhu, Ziqiang Xu, Zhenpeng Feng, Ljubisa Stankovic

专题命中 可控生成 :image editing(abstract);分类 cs.CV

Comments 19 pages, 17 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.02875 2024-08-06 cs.CV cs.CL cs.IR 57%

Enhancing Conceptual Understanding in Multimodal Contrastive Learning through Hard Negative Samples

Philipp J. Rösch, Norbert Oswald, Michaela Geierhos, Jindřich Libovický

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.21490 2024-08-01 eess.IV cs.AI cs.CV cs.LG 57%

Explainable and Controllable Motion Curve Guided Cardiac Ultrasound Video Generation

Junxuan Yu, Rusi Chen, Yongsong Zhou, Yanlin Chen, Yaofei Duan, Yuhao Huang, Han Zhou, Tan Tao, Xin Yang, Dong Ni

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted by MICCAI MLMI 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.20336 2024-07-31 cs.CV 57%

Sun Off, Lights On: Photorealistic Monocular Nighttime Simulation for Robust Semantic Perception

Konstantinos Tzevelekakis, Shutong Zhang, Luc Van Gool, Christos Sakaridis

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Submitted for review

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.14279 2024-07-31 cs.CV 57%

Zero123-6D: Zero-shot Novel View Synthesis for RGB Category-level 6D Pose Estimation

Francesco Di Felice, Alberto Remus, Stefano Gasperini, Benjamin Busam, Lionel Ott, Federico Tombari, Roland Siegwart, Carlo Alberto Avizzano

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments 6 pages, 2 reference pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.18595 2024-07-29 cs.CV 57%

LinguaLinker: Audio-Driven Portraits Animation with Implicit Facial Control Enhancement

Rui Zhang, Yixiao Fang, Zhengnan Lu, Pei Cheng, Zebiao Huang, Bin Fu

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.15931 2024-07-29 cs.CV cs.AI 57%

X-Portrait: Expressive Portrait Animation with Hierarchical Motion Attention

You Xie, Hongyi Xu, Guoxian Song, Chao Wang, Yichun Shi, Linjie Luo

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments SIGGRAPH 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.13675 2024-07-26 cs.CV 57%

MeshSegmenter: Zero-Shot Mesh Semantic Segmentation via Texture Synthesis

Ziming Zhong, Yanxu Xu, Jing Li, Jiale Xu, Zhengxin Li, Chaohui Yu, Shenghua Gao

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments The paper was accepted by ECCV2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.06903 2024-07-26 cs.CV cs.AI 57%

DreamScene360: Unconstrained Text-to-3D Scene Generation with Panoramic Gaussian Splatting

Shijie Zhou, Zhiwen Fan, Dejia Xu, Haoran Chang, Pradyumna Chari, Tejas Bharadwaj, Suya You, Zhangyang Wang, Achuta Kadambi

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.16224 2024-07-24 cs.CV 57%

OutfitAnyone: Ultra-high Quality Virtual Try-On for Any Clothing and Any Person

Ke Sun, Jian Cao, Qi Wang, Linrui Tian, Xindi Zhang, Lian Zhuo, Bang Zhang, Liefeng Bo, Wenbo Zhou, Weiming Zhang, Daiheng Gao

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments 10 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.14570 2024-07-24 cs.CV 57%

Are handcrafted filters helpful for attributing AI-generated images?

Jialiang Li, Haoyue Wang, Sheng Li, Zhenxing Qian, Xinpeng Zhang, Athanasios V. Vasilakos

专题命中 可控生成 :image generation(abstract);分类 cs.CV

Comments 9 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏