arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

视频大模型

视频理解、视频生成、视频语言模型和时序视觉推理。

共收录 6781 信号源:cs.CV, eess.IV, cs.MM

1. 视频扩散模型 1305 篇

2405.20155 2024-11-15 cs.CV cs.GR 79%

MotionDreamer: Exploring Semantic Video Diffusion features for Zero-Shot 3D Mesh Animation

Lukas Uzolas, Elmar Eisemann, Petr Kellnhofer

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.02397 2024-11-08 cs.CV 79%

Adaptive Caching for Faster Video Generation with Diffusion Transformers

Kumara Kahatapitiya, Haozhe Liu, Sen He, Ding Liu, Menglin Jia, Chenyang Zhang, Michael S. Ryoo, Tian Xie

专题命中 视频扩散模型 :video generation(title,abstract);分类 cs.CV

Comments Project-page is available at https://adacache-dit.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.11614 2024-11-06 cs.CV 79%

Dynamic Typography: Bringing Text to Life via Video Diffusion Prior

Zichen Liu, Yihao Meng, Hao Ouyang, Yue Yu, Bolin Zhao, Daniel Cohen-Or, Huamin Qu

专题命中 视频扩散模型 :video diffusion(title);text-to-video(abstract);分类 cs.CV

Comments Our demo and code is available at: https://animate-your-word.github.io/demo/

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.06890 2024-10-29 cs.CV 79%

Motion Consistency Model: Accelerating Video Diffusion with Disentangled Motion-Appearance Distillation

Yuanhao Zhai, Kevin Lin, Zhengyuan Yang, Linjie Li, Jianfeng Wang, Chung-Ching Lin, David Doermann, Junsong Yuan, Lijuan Wang

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments NeurIPS 2024; project page: https://yhzhai.github.io/mcm/

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.10774 2024-10-15 cs.CV 79%

Cavia: Camera-controllable Multi-view Video Diffusion with View-Integrated Attention

Dejia Xu, Yifan Jiang, Chen Huang, Liangchen Song, Thorsten Gernoth, Liangliang Cao, Zhangyang Wang, Hao Tang

专题命中 视频扩散模型 :video diffusion(title);video generation(abstract);分类 cs.CV

Comments Project Page: https://ir1d.github.io/Cavia/

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.01594 2024-10-03 cs.CV 79%

MM-LDM: Multi-Modal Latent Diffusion Model for Sounding Video Generation

Mingzhen Sun, Weining Wang, Yanyuan Qiao, Jiahui Sun, Zihan Qin, Longteng Guo, Xinxin Zhu, Jing Liu

专题命中 视频扩散模型 :video generation(title,abstract);分类 cs.CV

Comments Accepted by ACM MM 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.11398 2024-09-10 cs.CV 79%

Animate3D: Animating Any 3D Model with Multi-view Video Diffusion

Yanqin Jiang, Chaohui Yu, Chenjie Cao, Fan Wang, Weiming Hu, Jin Gao

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments Project Page: https://animate3d.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.02048 2024-09-04 cs.CV 79%

ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis

Wangbo Yu, Jinbo Xing, Li Yuan, Wenbo Hu, Xiaoyu Li, Zhipeng Huang, Xiangjun Gao, Tien-Tsin Wong, Ying Shan, Yonghong Tian

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments Project page: https://drexubery.github.io/ViewCrafter/

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.01595 2024-09-04 cs.CV 79%

DiVE: DiT-based Video Generation with Enhanced Control

Junpeng Jiang, Gangyi Hong, Lijun Zhou, Enhui Ma, Hengtong Hu, Xia Zhou, Jie Xiang, Fan Liu, Kaicheng Yu, Haiyang Sun, Kun Zhan, Peng Jia, Miao Zhang

专题命中 视频扩散模型 :video generation(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.05479 2024-08-13 cs.CV 79%

ReToMe-VA: Recursive Token Merging for Video Diffusion-based Unrestricted Adversarial Attack

Ziyi Gao, Kai Chen, Zhipeng Wei, Tingshu Mou, Jingjing Chen, Zhiyu Tan, Hao Li, Yu-Gang Jiang

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.14134 2024-08-12 cs.LG cs.CV cs.RO 79%

Diffusion Reward: Learning Rewards via Conditional Video Diffusion

Tao Huang, Guangqi Jiang, Yanjie Ze, Huazhe Xu

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments Accepted to ECCV 2024. Project page and code: https://diffusion-reward.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.17485 2024-08-09 cs.CV 79%

EMO: Emote Portrait Alive -- Generating Expressive Portrait Videos with Audio2Video Diffusion Model under Weak Conditions

Linrui Tian, Qi Wang, Bang Zhang, Liefeng Bo

专题命中 视频扩散模型 :video diffusion(title);video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.12034 2024-07-22 cs.CV cs.GR cs.LG 79%

VFusion3D: Learning Scalable 3D Generative Models from Video Diffusion Models

Junlin Han, Filippos Kokkinos, Philip Torr

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments ECCV 2024. Project page: https://junlinhan.github.io/projects/vfusion3d.html

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.11585 2024-07-18 cs.CV cs.AI 79%

QVD: Post-training Quantization for Video Diffusion Models

Shilong Tian, Hong Chen, Chengtao Lv, Yu Liu, Jinyang Guo, Xianglong Liu, Shengxi Li, Hao Yang, Tao Xie

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments accepted by ACMMM2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.08737 2024-07-12 cs.CV cs.AI cs.LG cs.RO 79%

Video Diffusion Alignment via Reward Gradients

Mihir Prabhudesai, Russell Mendonca, Zheyang Qin, Katerina Fragkiadaki, Deepak Pathak

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments Project Webpage: https://vader-vid.github.io; Code available at: https://github.com/mihirp1998/VADER

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.08701 2024-07-12 cs.CV 79%

Live2Diff: Live Stream Translation via Uni-directional Attention in Video Diffusion Models

Zhening Xing, Gereon Fox, Yanhong Zeng, Xingang Pan, Mohamed Elgharib, Christian Theobalt, Kai Chen

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments https://live2diff.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.06071 2024-06-21 cs.CV cs.LG physics.ao-ph stat.ML 79%

Precipitation Downscaling with Spatiotemporal Video Diffusion

Prakhar Srivastava, Ruihan Yang, Gavin Kerrigan, Gideon Dresdner, Jeremy McGibbon, Christopher Bretherton, Stephan Mandt

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.07686 2024-06-13 cs.CV 79%

AV-DiT: Efficient Audio-Visual Diffusion Transformer for Joint Audio and Video Generation

Kai Wang, Shijian Deng, Jing Shi, Dimitrios Hatzinakos, Yapeng Tian

专题命中 视频扩散模型 :video generation(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.04338 2024-06-12 cs.CV cs.AI cs.GR 79%

Physics3D: Learning Physical Properties of 3D Gaussians via Video Diffusion

Fangfu Liu, Hanyang Wang, Shunyu Yao, Shengjun Zhang, Jie Zhou, Yueqi Duan

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments Project page: https://liuff19.github.io/Physics3D

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.18156 2024-05-29 cs.CV 79%

VividPose: Advancing Stable Video Diffusion for Realistic Human Image Animation

Qilin Wang, Zhengkai Jiang, Chengming Xu, Jiangning Zhang, Yabiao Wang, Xinyi Zhang, Yun Cao, Weijian Cao, Chengjie Wang, Yanwei Fu

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.16645 2024-05-28 cs.CV 79%

Diffusion4D: Fast Spatial-temporal Consistent 4D Generation via Video Diffusion Models

Hanwen Liang, Yuyang Yin, Dejia Xu, Hanxue Liang, Zhangyang Wang, Konstantinos N. Plataniotis, Yao Zhao, Yunchao Wei

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments Project page: https://vita-group.github.io/Diffusion4D

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.15881 2024-05-28 cs.CV cs.AI cs.LG 79%

Scaling Diffusion Mamba with Bidirectional SSMs for Efficient Image and Video Generation

Shentong Mo, Yapeng Tian

专题命中 视频扩散模型 :video generation(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.13800 2024-03-21 cs.CV 79%

TimeRewind: Rewinding Time with Image-and-Events Video Diffusion

Jingxi Chen, Brandon Y. Feng, Haoming Cai, Mingyang Xie, Christopher Metzler, Cornelia Fermuller, Yiannis Aloimonos

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.12008 2024-03-19 cs.CV 79%

SV3D: Novel Multi-view Synthesis and 3D Generation from a Single Image using Latent Video Diffusion

Vikram Voleti, Chun-Han Yao, Mark Boss, Adam Letts, David Pankratz, Dmitry Tochilkin, Christian Laforte, Robin Rombach, Varun Jampani

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments Project page: https://sv3d.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.06738 2024-03-12 cs.CV 79%

V3D: Video Diffusion Models are Effective 3D Generators

Zilong Chen, Yikai Wang, Feng Wang, Zhengyi Wang, Huaping Liu

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments Code available at https://github.com/heheyas/V3D Project page: https://heheyas.github.io/V3D/

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.12644 2024-02-22 cs.CV 79%

Feature-Conditioned Cascaded Video Diffusion Models for Precise Echocardiogram Synthesis

Hadrien Reynaud, Mengyun Qiao, Mischa Dombrowski, Thomas Day, Reza Razavi, Alberto Gomez, Paul Leeson, Bernhard Kainz

专题命中 视频扩散模型 :video diffusion(title);video generation(abstract);分类 cs.CV

Comments Published in MICCAI 2023 proceedings. https://link.springer.com/chapter/10.1007/978-3-031-43999-5_14

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.06088 2024-02-12 cs.CV 79%

Animated Stickers: Bringing Stickers to Life with Video Diffusion

David Yan, Winnie Zhang, Luxin Zhang, Anmol Kalia, Dingkang Wang, Ankit Ramchandani, Miao Liu, Albert Pumarola, Edgar Schoenfeld, Elliot Blanchard, Krishna Narni, Yaqiao Luo, Lawrence Chen, Guan Pang, Ali Thabet, Peter Vajda, Amy Bearman, Licheng Yu

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.01305 2023-12-05 cs.CV cs.AI cs.GR 79%

ViVid-1-to-3: Novel View Synthesis with Video Diffusion Models

Jeong-gi Kwak, Erqun Dong, Yuhe Jin, Hanseok Ko, Shweta Mahajan, Kwang Moo Yi

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments Project page: https://jgkwak95.github.io/ViVid-1-to-3/

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.08320 2023-10-16 cs.CV 79%

VideoFusion: Decomposed Diffusion Models for High-Quality Video Generation

Zhengxiong Luo, Dayou Chen, Yingya Zhang, Yan Huang, Liang Wang, Yujun Shen, Deli Zhao, Jingren Zhou, Tieniu Tan

专题命中 视频扩散模型 :video generation(title,abstract);分类 cs.CV

Comments Accepted to CVPR2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.09478 2023-03-27 cs.CV 79%

MM-Diffusion: Learning Multi-Modal Diffusion Models for Joint Audio and Video Generation

Ludan Ruan, Yiyang Ma, Huan Yang, Huiguo He, Bei Liu, Jianlong Fu, Nicholas Jing Yuan, Qin Jin, Baining Guo

专题命中 视频扩散模型 :video generation(title,abstract);分类 cs.CV

Comments Accepted by CVPR 2023

详情

展开后加载摘要…

URL PDF HTML 收藏