arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 4211 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 4211 篇

2501.18801 2025-02-03 cs.CV cs.AI 57%

Every Image Listens, Every Image Dances: Music-Driven Image Animation

Zhikang Dong, Weituo Hao, Ju-Chiang Wang, Peng Zhang, Pawel Polak

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.18726 2025-02-03 cs.CV 57%

Strong and Controllable 3D Motion Generation

Canxuan Gang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments technical report

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.15839 2025-01-28 cs.CV 57%

Controllable Hand Grasp Generation for HOI and Efficient Evaluation Methods

Ishant, Rongliang Wu, Joo Hwee Lim

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.15648 2025-01-28 cs.CV cs.AI cs.LG 57%

Can Pose Transfer Models Generate Realistic Human Motion?

Vaclav Knapp, Matyas Bohacek

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Data and code available at https://github.com/matyasbohacek/pose-transfer-human-motion

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.14533 2025-01-27 cs.CV 57%

CheapNVS: Real-Time On-Device Narrow-Baseline Novel View Synthesis

Konstantinos Georgiadis, Mehmet Kerim Yucel, Albert Saa-Garriga

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

Comments Accepted to ICASSP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.10021 2025-01-22 cs.CV 57%

X-Dyna: Expressive Dynamic Human Image Animation

Di Chang, Hongyi Xu, You Xie, Yipeng Gao, Zhengfei Kuang, Shengqu Cai, Chenxu Zhang, Guoxian Song, Chao Wang, Yichun Shi, Zeyuan Chen, Shijie Zhou, Linjie Luo, Gordon Wetzstein, Mohammad Soleymani

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Project page:https://x-dyna.github.io/xdyna.github.io/ Code:https://github.com/bytedance/X-Dyna Model:https://huggingface.co/Boese0601/X-Dyna

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.09393 2025-01-17 cs.CV 57%

SVIA: A Street View Image Anonymization Framework for Self-Driving Applications

Dongyu Liu, Xuhong Wang, Cen Chen, Yanhao Wang, Shengyue Yao, Yilun Lin

专题命中 可控生成 :image generation(abstract);分类 cs.CV

Comments 8 pages, 6 figures, 3 tables. Accepted by IEEE ITSC 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.08649 2025-01-16 cs.CV cs.LG 57%

Joint Learning of Depth and Appearance for Portrait Image Animation

Xinya Ji, Gaspard Zoss, Prashanth Chandran, Lingchen Yang, Xun Cao, Barbara Solenthaler, Derek Bradley

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.03335 2025-01-15 cs.SD cs.CV cs.LG eess.AS 57%

Audio-Agent: Leveraging LLMs For Audio Generation, Editing and Composition

Zixuan Wang, Chi-Keung Tang, Yu-Wing Tai

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.02962 2025-01-08 cs.CV 57%

SceneVTG++: Controllable Multilingual Visual Text Generation in the Wild

Jiawei Liu, Yuanzhi Zhu, Feiyu Gao, Zhibo Yang, Peng Wang, Junyang Lin, Xinggang Wang, Wenyu Liu

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.02706 2025-01-07 cs.CV 57%

Multilevel Semantic-Aware Model for AI-Generated Video Quality Assessment

Jiaze Li, Haoran Xu, Shiding Zhu, Junwei He, Haozhao Wang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.02264 2025-01-07 cs.CV 57%

Unsupervised Class Generation to Expand Semantic Segmentation Datasets

Javier Montalvo, Álvaro García-Martín, Pablo Carballeira, Juan C. SanMiguel

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.11475 2025-01-07 cs.CV 57%

TrackGo: A Flexible and Efficient Method for Controllable Video Generation

Haitao Zhou, Chuang Wang, Rui Nie, Jinlin Liu, Dongdong Yu, Qian Yu, Changhu Wang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted by AAAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.00816 2025-01-03 cs.CV 57%

MixSA: Training-free Reference-based Sketch Extraction via Mixture-of-Self-Attention

Rui Yang, Xiaojun Wu, Shengfeng He

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments 25 pages, 25 figures; Accepted by IEEE IEEE Transactions on Visualization and Computer Graphics, 2024 (TVCG)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.08394 2025-01-03 cs.CV 57%

VisionLLM v2: An End-to-End Generalist Multimodal Large Language Model for Hundreds of Vision-Language Tasks

Jiannan Wu, Muyan Zhong, Sen Xing, Zeqiang Lai, Zhaoyang Liu, Zhe Chen, Wenhai Wang, Xizhou Zhu, Lewei Lu, Tong Lu, Ping Luo, Yu Qiao, Jifeng Dai

专题命中 可控生成 :image generation(abstract);分类 cs.CV

Comments 44 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.20901 2024-12-31 cs.CV cs.AI 57%

ILDiff: Generate Transparent Animated Stickers by Implicit Layout Distillation

Ting Zhang, Zhiqiang Yuan, Yeshuang Zhu, Jinchao Zhang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.19458 2024-12-31 cs.CV 57%

DriveEditor: A Unified 3D Information-Guided Framework for Controllable Object Editing in Driving Scenes

Yiyuan Liang, Zhiying Yan, Liqun Chen, Jiahuan Zhou, Luxin Yan, Sheng Zhong, Xu Zou

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments AAAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.19759 2024-12-31 cs.CV 57%

MotionLCM: Real-time Controllable Motion Generation via Latent Consistency Model

Wenxun Dai, Ling-Hao Chen, Jingbo Wang, Jinpeng Liu, Bo Dai, Yansong Tang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments MotionLCM project version 1.0 (ECCV 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.20327 2024-12-31 cs.CV 57%

Motion Transfer-Driven intra-class data augmentation for Finger Vein Recognition

Xiu-Feng Huang, Lai-Man Po, Wei-Feng Ou

专题命中 可控生成 :image generation(abstract);分类 cs.CV

Comments 5 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.20162 2024-12-31 cs.CV 57%

Multi-Modality Driven LoRA for Adverse Condition Depth Estimation

Guanglei Yang, Rui Tian, Yongqiang Zhang, Zhun Zhong, Yongqiang Li, Wangmeng Zuo

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.19518 2024-12-30 cs.CV 57%

Dust to Tower: Coarse-to-Fine Photo-Realistic Scene Reconstruction from Sparse Uncalibrated Images

Xudong Cai, Yongcai Wang, Zhaoxin Fan, Deng Haoran, Shuo Wang, Wanting Li, Deying Li, Lun Luo, Minhang Wang, Jintao Xu

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.17290 2024-12-30 cs.CV 57%

Free-viewpoint Human Animation with Pose-correlated Reference Selection

Fa-Ting Hong, Zhan Xu, Haiyang Liu, Qinjie Lin, Luchuan Song, Zhixin Shu, Yang Zhou, Duygu Ceylan, Dan Xu

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Under review; Project page: https://harlanhong.github.io/publications/fvhuman/index.html

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.15798 2024-12-30 eess.IV cs.CV 57%

M3-CVC: Controllable Video Compression with Multimodal Generative Models

Rui Wan, Qi Zheng, Yibo Fan

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted to ICASSP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.10889 2024-12-23 cs.CV cs.AI 57%

Synthesizing Moving People with 3D Control

Boyi Li, Junming Chen, Jathushan Rajasegaran, Yossi Gandelsman, Alexei A. Efros, Jitendra Malik

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.15673 2024-12-23 cs.CV 57%

Learning Group Interactions and Semantic Intentions for Multi-Object Trajectory Prediction

Mengshi Qi, Yuxin Yang, Huadong Ma

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.15664 2024-12-23 cs.CV 57%

SCENIC: Scene-aware Semantic Navigation with Instruction-guided Control

Xiaohan Zhang, Sebastian Starke, Vladimir Guzov, Zhensong Zhang, Eduardo Pérez Pellitero, Gerard Pons-Moll

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.15590 2024-12-23 cs.CV cs.CR 57%

SemDP: Semantic-level Differential Privacy Protection for Face Datasets

Xiaoting Zhang, Tao Wang, Junhao Ji

专题命中 可控生成 :image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.13635 2024-12-19 cs.CV 57%

Self-control: A Better Conditional Mechanism for Masked Autoregressive Model

Qiaoying Qu, Shiyu Shen

专题命中 可控生成 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.11067 2024-12-19 cs.CV 57%

CFSynthesis: Controllable and Free-view 3D Human Video Synthesis

Liyuan Cui, Xiaogang Xu, Wenqi Dong, Zesong Yang, Hujun Bao, Zhaopeng Cui

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.12129 2024-12-18 cs.LG cs.AI cs.CV 57%

SceneDiffuser: Efficient and Controllable Driving Simulation Initialization and Rollout

Chiyu Max Jiang, Yijing Bai, Andre Cornman, Christopher Davis, Xiukun Huang, Hong Jeon, Sakshum Kulshrestha, John Lambert, Shuangyu Li, Xuanyu Zhou, Carlos Fuertes, Chang Yuan, Mingxing Tan, Yin Zhou, Dragomir Anguelov

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted to NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏