arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 4215 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 4215 篇

2302.08212 2024-05-01 cs.CV 57%

Visible-Infrared Person Re-Identification via Patch-Mixed Cross-Modality Learning

Zhihao Qian, Yutian Lin, Bo Du

专题命中 可控生成 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.16581 2024-04-26 cs.CV 57%

AudioScenic: Audio-Driven Video Scene Editing

Kaixin Shen, Ruijie Quan, Linchao Zhu, Jun Xiao, Yi Yang

专题命中 可控生成 :image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.13299 2024-04-23 cs.CV 57%

PCQA: A Strong Baseline for AIGC Quality Assessment Based on Prompt Condition

Xi Fang, Weigang Wang, Xiaoxin Lv, Jun Yan

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Published in CVPR-2024's NTIRE: New Trends in Image Restoration and Enhancement workshop and challenges

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.11554 2024-04-18 cs.CV 57%

Predicting Long-horizon Futures by Conditioning on Geometry and Time

Tarasha Khurana, Deva Ramanan

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Project page: http://www.cs.cmu.edu/~tkhurana/depthforecasting/

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.17121 2024-04-18 cs.CV cs.LG 57%

ScribbleGen: Generative Data Augmentation Improves Scribble-supervised Semantic Segmentation

Jacob Schnell, Jieke Wang, Lu Qi, Vincent Tao Hu, Meng Tang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.03031 2024-04-18 cs.CV 57%

MCM: Multi-condition Motion Synthesis Framework for Multi-scenario

Zeyu Ling, Bo Han, Yongkang Wong, Mohan Kangkanhalli, Weidong Geng

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.01203 2024-04-18 cs.LG cs.CV 57%

Neural Language of Thought Models

Yi-Fu Wu, Minseung Lee, Sungjin Ahn

专题命中 可控生成 :image generation(abstract);分类 cs.CV

Comments Accepted in ICLR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.10307 2024-04-17 cs.CV cs.AI 57%

Learnable Prompt for Few-Shot Semantic Segmentation in Remote Sensing Domain

Steve Andreas Immanuel, Hagai Raja Sinulingga

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

Comments Accepted to CVPRW 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.07039 2024-04-17 cs.CV 57%

Open-Pose 3D Zero-Shot Learning: Benchmark and Challenges

Weiguang Zhao, Guanyu Yang, Rui Zhang, Chenru Jiang, Chaolong Yang, Yuyao Yan, Amir Hussain, Kaizhu Huang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.09111 2024-04-16 cs.CV 57%

Exploring Generative AI for Sim2Real in Driving Data Synthesis

Haonan Zhao, Yiting Wang, Thomas Bashford-Rogers, Valentina Donzella, Kurt Debattista

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.00513 2024-04-16 cs.CV 57%

Transformer based Pluralistic Image Completion with Reduced Information Loss

Qiankun Liu, Yuqi Jiang, Zhentao Tan, Dongdong Chen, Ying Fu, Qi Chu, Gang Hua, Nenghai Yu

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

Comments Accepted by TPAMI (2024). arXiv admin note: text overlap with arXiv:2205.05076

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.06451 2024-04-10 cs.CV 57%

SmartControl: Enhancing ControlNet for Handling Rough Visual Conditions

Xiaoyu Liu, Yuxiang Wei, Ming Liu, Xianhui Lin, Peiran Ren, Xuansong Xie, Wangmeng Zuo

专题命中 可控生成 :text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.05661 2024-04-09 cs.CV 57%

Automatic Controllable Colorization via Imagination

Xiaoyan Cong, Yue Wu, Qifeng Chen, Chenyang Lei

专题命中 可控生成 :image generation(abstract);分类 cs.CV

Comments CVPR 2024. Project page: https://xy-cong.github.io/imagine-colorization

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.05626 2024-04-09 cs.CV 57%

Learning a Category-level Object Pose Estimator without Pose Annotations

Fengrui Tian, Yaoyao Liu, Adam Kortylewski, Yueqi Duan, Shaoyi Du, Alan Yuille, Angtian Wang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.03656 2024-04-05 cs.CV 57%

MVD-Fusion: Single-view 3D via Depth-consistent Multi-view Generation

Hanzhe Hu, Zhizhuo Zhou, Varun Jampani, Shubham Tulsiani

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Project page: https://mvd-fusion.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.03256 2024-04-05 cs.CV 57%

Multi Positive Contrastive Learning with Pose-Consistent Generated Images

Sho Inayoshi, Aji Resindra Widya, Satoshi Ozaki, Junji Otsuka, Takeshi Ohashi

专题命中 可控生成 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.13856 2024-04-05 eess.IV cs.CV cs.LG 57%

Robust deep learning for eye fundus images: Bridging real and synthetic data for enhancing generalization

Guilherme C. Oliveira, Gustavo H. Rosa, Daniel C. G. Pedronette, João P. Papa, Himeesh Kumar, Leandro A. Passos, Dinesh Kumar

专题命中 可控生成 :image generation(abstract);分类 cs.CV

Comments Accepted by the Biomedical Signal Processing and Control

Journal ref Biomedical Signal Processing and Control, 94 (2024), 106263

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.02561 2024-04-04 cs.CV 57%

Semantic Human Mesh Reconstruction with Textures

Xiaoyu Zhan, Jianxin Yang, Yuanqi Li, Jie Guo, Yanwen Guo, Wenping Wang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted to CVPR 2024. Project page: https://zhanxy.xyz/projects/shert/

详情

展开后加载摘要…

URL PDF HTML 收藏
2007.03408 2024-04-04 cs.CV cs.LG stat.ML 57%

A Generative Model for Texture Synthesis based on Optimal Transport between Feature Distributions

Antoine Houdard, Arthur Leclaire, Nicolas Papadakis, Julien Rabin

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

Journal ref Journal of Mathematical Imaging and Vision, Volume 65, pages 4-28, (2023)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.02125 2024-04-03 cs.CV 57%

3D Congealing: 3D-Aware Image Alignment in the Wild

Yunzhi Zhang, Zizhang Li, Amit Raj, Andreas Engelhardt, Yuanzhen Li, Tingbo Hou, Jiajun Wu, Varun Jampani

专题命中 可控生成 :image editing(abstract);分类 cs.CV

Comments Project page: https://ai.stanford.edu/~yzzhang/projects/3d-congealing/

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.00658 2024-04-03 cs.CV 57%

KTPFormer: Kinematics and Trajectory Prior Knowledge-Enhanced Transformer for 3D Human Pose Estimation

Jihua Peng, Yanghong Zhou, P. Y. Mok

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted by CVPR 2024,GitHub code:https://github.com/JihuaPeng/KTPFormer

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.00274 2024-04-01 cs.CV cs.SD eess.AS 57%

CustomListener: Text-guided Responsive Interaction for User-friendly Listening Head Generation

Xi Liu, Ying Guo, Cheng Zhen, Tong Li, Yingying Ao, Pengfei Yan

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted by CVPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.17532 2024-03-28 cs.CV 57%

Weakly-Supervised Emotion Transition Learning for Diverse 3D Co-speech Gesture Generation

Xingqun Qi, Jiahao Pan, Peng Li, Ruibin Yuan, Xiaowei Chi, Mengfei Li, Wenhan Luo, Wei Xue, Shanghang Zhang, Qifeng Liu, Yike Guo

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

Comments Accepted by CVPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.17664 2024-03-27 cs.CV 57%

DiffFAE: Advancing High-fidelity One-shot Facial Appearance Editing with Space-sensitive Customization and Semantic Preservation

Qilin Wang, Jiangning Zhang, Chengming Xu, Weijian Cao, Ying Tai, Yue Han, Yanhao Ge, Hong Gu, Chengjie Wang, Yanwei Fu

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.17631 2024-03-27 cs.CV 57%

AniArtAvatar: Animatable 3D Art Avatar from a Single Image

Shaoxu Li

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.03611 2024-03-27 cs.CV cs.AI cs.LG 57%

DreamComposer: Controllable 3D Object Generation via Multi-View Conditions

Yunhan Yang, Yukun Huang, Xiaoyang Wu, Yuan-Chen Guo, Song-Hai Zhang, Hengshuang Zhao, Tong He, Xihui Liu

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Project Page: https://yhyang-myron.github.io/DreamComposer/

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.16194 2024-03-26 cs.CV 57%

Pose-Guided Self-Training with Two-Stage Clustering for Unsupervised Landmark Discovery

Siddharth Tourani, Ahmed Alwheibi, Arif Mahmood, Muhammad Haris Khan

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted in CVPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.14003 2024-03-22 cs.CV cs.CL cs.LG 57%

Multi-Modal Hallucination Control by Visual Information Grounding

Alessandro Favero, Luca Zancato, Matthew Trager, Siddharth Choudhary, Pramuditha Perera, Alessandro Achille, Ashwin Swaminathan, Stefano Soatto

专题命中 可控生成 :generative vision(abstract);分类 cs.CV

Journal ref IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.04302 2024-03-22 cs.CV cs.CL 57%

Prompt Highlighter: Interactive Control for Multi-Modal LLMs

Yuechen Zhang, Shengju Qian, Bohao Peng, Shu Liu, Jiaya Jia

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments CVPR 2024; Project Page: https://julianjuaner.github.io/projects/PromptHighlighter

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.10261 2024-03-21 cs.CV 57%

Learning Spatiotemporal Inconsistency via Thumbnail Layout for Face Deepfake Detection

Yuting Xu, Jian Liang, Lijun Sheng, Xiao-Yu Zhang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted by IJCV

详情

展开后加载摘要…

URL PDF HTML 收藏