arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

视频大模型

视频理解、视频生成、视频语言模型和时序视觉推理。

共收录 1299 信号源:cs.CV, eess.IV, cs.MM

1. 视频扩散模型 1299 篇

2405.16947 2024-05-28 cs.CV 57%

Zero-Shot Video Semantic Segmentation based on Pre-Trained Diffusion Models

Qian Wang, Abdelrahman Eldesokey, Mohit Mendiratta, Fangneng Zhan, Adam Kortylewski, Christian Theobalt, Peter Wonka

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

Comments Project webpage: https://qianwangx.github.io/VidSeg_diffusion/

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.16854 2024-05-08 cs.CV 57%

A Unified Approach for Text- and Image-guided 4D Scene Generation

Yufeng Zheng, Xueting Li, Koki Nagano, Sifei Liu, Karsten Kreis, Otmar Hilliges, Shalini De Mello

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

Comments Project page: https://research.nvidia.com/labs/nxp/dream-in-4d/

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.08068 2024-05-06 cs.CV cs.AI cs.LG 57%

DORSal: Diffusion for Object-centric Representations of Scenes et al

Allan Jabri, Sjoerd van Steenkiste, Emiel Hoogeboom, Mehdi S. M. Sajjadi, Thomas Kipf

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

Comments Accepted to ICLR 2024. Project page: https://www.sjoerdvansteenkiste.com/dorsal

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.19277 2024-05-01 cs.CV 57%

Bridge to Non-Barrier Communication: Gloss-Prompted Fine-grained Cued Speech Gesture Generation with Diffusion Model

Wentao Lei, Li Liu, Jun Wang

专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV

Journal ref IJCAI 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.20092 2024-04-08 cs.LG cs.CV 57%

The Missing U for Efficient Diffusion Models

Sergio Calvo-Ordonez, Chun-Wun Cheng, Jiahao Huang, Lipei Zhang, Guang Yang, Carola-Bibiane Schonlieb, Angelica I Aviles-Rivero

专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV

Comments 23 pages, 14 figures, Accepted at Transactions of Machine Learning Research (04/2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.01709 2024-04-03 cs.CV cs.AI 57%

Upsample Guidance: Scale Up Diffusion Models without Training

Juno Hwang, Yong-Hyun Park, Junghyo Jo

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

Comments 15 pages, 15 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.10786 2024-04-02 cs.CV 57%

Sat2Scene: 3D Urban Scene Generation from Satellite Images with Diffusion

Zuoyue Li, Zhenqiang Li, Zhaopeng Cui, Marc Pollefeys, Martin R. Oswald

专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV

Journal ref CVPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.16530 2024-03-26 cs.CV cs.AI 57%

An Intermediate Fusion ViT Enables Efficient Text-Image Alignment in Diffusion Models

Zizhao Hu, Shaochong Jia, Mohammad Rostami

专题命中 视频扩散模型 :text-to-video(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.14939 2024-03-25 cs.CV 57%

STAG4D: Spatial-Temporal Anchored Generative 4D Gaussians

Yifei Zeng, Yanqin Jiang, Siyu Zhu, Yuanxun Lu, Youtian Lin, Hao Zhu, Weiming Hu, Xun Cao, Yao Yao

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.09368 2024-03-21 cs.CV cs.AI 57%

Magic-Me: Identity-Specific Video Customized Diffusion

Ze Ma, Daquan Zhou, Chun-Hsiao Yeh, Xue-She Wang, Xiuyu Li, Huanrui Yang, Zhen Dong, Kurt Keutzer, Jiashi Feng

专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV

Comments Project Page at https://magic-me-webpage.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.12706 2024-03-20 cs.CV cs.AI 57%

AnimateDiff-Lightning: Cross-Model Diffusion Distillation

Shanchuan Lin, Xiao Yang

专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.08902 2024-03-15 cs.CV 57%

Envision3D: One Image to 3D with Anchor Views Interpolation

Yatian Pang, Tanghui Jia, Yujun Shi, Zhenyu Tang, Junwu Zhang, Xinhua Cheng, Xing Zhou, Francis E. H. Tay, Li Yuan

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

Comments GitHub repository: https://github.com/PKU-YuanGroup/Envision3D

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.08764 2024-03-14 cs.CV 57%

VLOGGER: Multimodal Diffusion for Embodied Avatar Synthesis

Enric Corona, Andrei Zanfir, Eduard Gabriel Bazavan, Nikos Kolotouros, Thiemo Alldieck, Cristian Sminchisescu

专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV

Comments Project web: https://enriccorona.github.io/vlogger/

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.14603 2024-02-20 cs.CV 57%

Animate124: Animating One Image to 4D Dynamic Scene

Yuyang Zhao, Zhiwen Yan, Enze Xie, Lanqing Hong, Zhenguo Li, Gim Hee Lee

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

Comments Project Page: https://animate124.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.01566 2024-02-05 cs.CV cs.AI 57%

Boximator: Generating Rich and Controllable Motions for Video Synthesis

Jiawei Wang, Yuchen Zhang, Jiaxin Zou, Yan Zeng, Guoqiang Wei, Liping Yuan, Hang Li

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

Comments 16 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.10822 2024-01-22 cs.CV 57%

ActAnywhere: Subject-Aware Video Background Generation

Boxiao Pan, Zhan Xu, Chun-Hao Paul Huang, Krishna Kumar Singh, Yang Zhou, Leonidas J. Guibas, Jimei Yang

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.08232 2024-01-17 cs.CV 57%

Multi-scale 2D Temporal Map Diffusion Models for Natural Language Video Localization

Chongzhi Zhang, Mingyuan Zhang, Zhiyang Teng, Jiayi Li, Xizhou Zhu, Lewei Lu, Ziwei Liu, Aixin Sun

专题命中 视频扩散模型 :video understanding(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.05870 2024-01-12 cs.CV cs.AI 57%

HiCAST: Highly Customized Arbitrary Style Transfer with Adapter Enhanced Diffusion Models

Hanzhang Wang, Haoran Wang, Jinze Yang, Zhongrui Yu, Zeke Xie, Lei Tian, Xinyan Xiao, Junjun Jiang, Xianming Liu, Mingming Sun

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.05288 2024-01-04 cs.CV 57%

MotionCrafter: One-Shot Motion Customization of Diffusion Models

Yuxin Zhang, Fan Tang, Nisha Huang, Haibin Huang, Chongyang Ma, Weiming Dong, Changsheng Xu

专题命中 视频扩散模型 :text-to-video(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.13305 2023-12-22 cs.CV 57%

DVIS++: Improved Decoupled Framework for Universal Video Segmentation

Tao Zhang, Xingye Tian, Yikang Zhou, Shunping Ji, Xuebo Wang, Xin Tao, Yuan Zhang, Pengfei Wan, Zhongyuan Wang, Yu Wu

专题命中 视频扩散模型 :long video(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.12030 2023-12-20 cs.CV cs.AI 57%

Towards Accurate Guided Diffusion Sampling through Symplectic Adjoint Method

Jiachun Pan, Hanshu Yan, Jun Hao Liew, Jiashi Feng, Vincent Y. F. Tan

专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.01567 2023-11-06 cs.CV 57%

Exploring the Hyperparameter Space of Image Diffusion Models for Echocardiogram Generation

Hadrien Reynaud, Bernhard Kainz

专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV

Comments MedNeurIPS 2023 poster

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.11497 2023-10-19 cs.CV 57%

FreeU: Free Lunch in Diffusion U-Net

Chenyang Si, Ziqi Huang, Yuming Jiang, Ziwei Liu

专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV

Comments Method update: we proposed structure-based scaling to enhance the performance of FreeU. Project page: https://chenyangsi.top/FreeU/

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.14108 2023-10-13 cs.CV 57%

3DDesigner: Towards Photorealistic 3D Object Generation and Editing with Text-guided Diffusion Models

Gang Li, Heliang Zheng, Chaoyue Wang, Chang Li, Changwen Zheng, Dacheng Tao

专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV

Comments Submitted to IJCV

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.14073 2023-08-04 cs.CV 57%

VideoControlNet: A Motion-Guided Video-to-Video Translation Framework by Using Diffusion Model with ControlNet

Zhihao Hu, Dong Xu

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2301.03396 2023-08-01 cs.CV 57%

Diffused Heads: Diffusion Models Beat GANs on Talking-Face Generation

Michał Stypułkowski, Konstantinos Vougioukas, Sen He, Maciej Zięba, Stavros Petridis, Maja Pantic

专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.11743 2023-06-21 cs.CV cs.LG 57%

SinFusion: Training Diffusion Models on a Single Image or Video

Yaniv Nikankin, Niv Haim, Michal Irani

专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV

Comments Project Page: https://yanivnik.github.io/sinfusion

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.04001 2023-05-24 cs.CV cs.AI 57%

AADiff: Audio-Aligned Video Synthesis with Text-to-Image Diffusion

Seungwoo Lee, Chaerin Kong, Donghyeon Jeon, Nojun Kwak

专题命中 视频扩散模型 :text-to-video(abstract);分类 cs.CV

Comments CVPR2023 Workshop on AI for Content Creation. Project Page: https://lifrary.github.io/AADiff/

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.00235 2022-12-02 cs.CV 57%

VIDM: Video Implicit Diffusion Models

Kangfu Mei, Vishal M. Patel

专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV

Comments AAAI2023 https://kfmei.page/vidm/

详情

展开后加载摘要…

URL PDF HTML 收藏
1809.04403 2019-01-17 cs.CV cs.LG 57%

Label Denoising with Large Ensembles of Heterogeneous Neural Networks

Pavel Ostyakov, Elizaveta Logacheva, Roman Suvorov, Vladimir Aliev, Gleb Sterkin, Oleg Khomenko, Sergey I. Nikolenko

专题命中 视频扩散模型 :video understanding(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏