arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

视频大模型

视频理解、视频生成、视频语言模型和时序视觉推理。

共收录 6781 信号源:cs.CV, eess.IV, cs.MM

1. 视频扩散模型 1305 篇

2504.02764 2025-04-04 cs.CV cs.AI 83%

Scene Splatter: Momentum 3D Scene Generation from Single Image with Video Diffusion Model

Shengjun Zhang, Jinzhao Li, Xin Fei, Hao Liu, Yueqi Duan

专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);分类 cs.CV

Comments CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.19462 2025-03-26 cs.CV 83%

AccVideo: Accelerating Video Diffusion Model with Synthetic Dataset

Haiyu Zhang, Xinyuan Chen, Yaohui Wang, Xihui Liu, Yunhong Wang, Yu Qiao

专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);分类 cs.CV

Comments Project Page: https://aejion.github.io/accvideo/

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.08244 2025-03-26 cs.CV 83%

FloVD: Optical Flow Meets Video Diffusion Model for Enhanced Camera-Controlled Video Synthesis

Wonjoon Jin, Qi Dai, Chong Luo, Seung-Hwan Baek, Sunghyun Cho

专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);分类 cs.CV

Comments Our paper has been accepted to CVPR 2025. Website: https://jinwonjoon.github.io/flovd_site/ Code: https://github.com/JinWonjoon/FloVD

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.19355 2025-03-13 cs.CV 83%

FasterCache: Training-Free Video Diffusion Model Acceleration with High Quality

Zhengyao Lv, Chenyang Si, Junhao Song, Zhenyu Yang, Yu Qiao, Ziwei Liu, Kwan-Yee K. Wong

专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.14801 2025-03-05 cs.CV 83%

AVD2: Accident Video Diffusion for Accident Video Description

Cheng Li, Keyuan Zhou, Tong Liu, Yu Wang, Mingqiao Zhuang, Huan-ang Gao, Bu Jin, Hao Zhao

专题命中 视频扩散模型 :video diffusion(title,abstract);video understanding(abstract);分类 cs.CV

Comments ICRA 2025, Project Page: https://an-answer-tree.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.06527 2025-02-21 cs.CV 83%

CustomVideoX: 3D Reference Attention Driven Dynamic Adaptation for Zero-Shot Customized Video Diffusion Transformers

D. She, Mushui Liu, Jingxuan Pang, Jin Wang, Zhen Yang, Wanggui He, Guanghao Zhang, Yi Wang, Qihan Huang, Haobin Tang, Yunlong Yu, Siming Fu

专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);分类 cs.CV

Comments Section 4 in CustomVideoX Entity Region-Aware Enhancement has description errors. The compared methods data of Table I lacks other metrics

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.17042 2025-02-18 cs.CV 83%

Adapting Image-to-Video Diffusion Models for Large-Motion Frame Interpolation

Luoxu Jin, Hiroshi Watanabe

专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.13301 2025-01-31 cs.CV cs.RO 83%

ARDuP: Active Region Video Diffusion for Universal Policies

Shuaiyi Huang, Mara Levy, Zhenyu Jiang, Anima Anandkumar, Yuke Zhu, Linxi Fan, De-An Huang, Abhinav Shrivastava

专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);分类 cs.CV

Comments Accepted by IROS 2024 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.08225 2025-01-15 cs.CV 83%

FramePainter: Endowing Interactive Image Editing with Video Diffusion Priors

Yabo Zhang, Xinpeng Zhou, Yihan Zeng, Hang Xu, Hui Li, Wangmeng Zuo

专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);分类 cs.CV

Comments Code: https://github.com/YBYBZhang/FramePainter

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.10150 2025-01-09 cs.CV 83%

Motion-Zero: Zero-Shot Moving Object Control Framework for Diffusion-Based Video Generation

Changgu Chen, Junwei Shu, Gaoqi He, Changbo Wang, Yang Li

专题命中 视频扩散模型 :video generation(title);video diffusion(abstract);text-to-video(abstract);分类 cs.CV

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.02690 2025-01-07 cs.CV 83%

GS-DiT: Advancing Video Generation with Pseudo 4D Gaussian Fields through Efficient Dense 3D Point Tracking

Weikang Bian, Zhaoyang Huang, Xiaoyu Shi, Yijin Li, Fu-Yun Wang, Hongsheng Li

专题命中 视频扩散模型 :video generation(title,abstract);video diffusion(abstract);分类 cs.CV

Comments Project Page: https://wkbian.github.io/Projects/GS-DiT/

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.13423 2024-12-30 cs.CV 83%

Decoupled Video Generation with Chain of Training-free Diffusion Model Experts

Wenhao Li, Yichao Cao, Xiu Su, Xi Lin, Shan You, Mingkai Zheng, Yi Chen, Chang Xu

专题命中 视频扩散模型 :video generation(title,abstract);video diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.09828 2024-12-16 cs.CV 83%

MSC: Multi-Scale Spatio-Temporal Causal Attention for Autoregressive Video Diffusion

Xunnong Xu, Mengying Cao

专题命中 视频扩散模型 :video diffusion(title);video generation(abstract);long video(abstract);分类 cs.CV

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.04956 2024-12-13 cs.CV cs.AI 83%

Uncovering Hidden Subspaces in Video Diffusion Models Using Re-Identification

Mischa Dombrowski, Hadrien Reynaud, Bernhard Kainz

专题命中 视频扩散模型 :video diffusion(title,abstract);long video(abstract);分类 cs.CV

Comments 8 pages, 5 tables, 6 figures; v2 Acknowledgements added

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06029 2024-12-10 cs.CV 83%

Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training

Zhenghong Zhou, Jie An, Jiebo Luo

专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);分类 cs.CV

Comments Project Page: https://latent-reframe.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.04364 2024-12-10 cs.CV cs.AI cs.LG 83%

VideoGuide: Improving Video Diffusion Models without Training Through a Teacher's Guide

Dohun Lee, Bryan S Kim, Geon Yeong Park, Jong Chul Ye

专题命中 视频扩散模型 :video diffusion(title,abstract);text-to-video(abstract);分类 cs.CV

Comments 26 pages, 19 figures, Project Page: https://dohunlee1.github.io/videoguide.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.05275 2024-12-09 cs.CV cs.AI 83%

MotionFlow: Attention-Driven Motion Transfer in Video Diffusion Models

Tuna Han Salih Meral, Hidir Yesiltepe, Connor Dunlop, Pinar Yanardag

专题命中 视频扩散模型 :video diffusion(title,abstract);text-to-video(abstract);分类 cs.CV

Comments Project Page: https://motionflow-diffusion.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.04448 2024-12-06 cs.CV 83%

MEMO: Memory-Guided Diffusion for Expressive Talking Video Generation

Longtao Zheng, Yifan Zhang, Hanzhong Guo, Jiachun Pan, Zhenxiong Tan, Jiahao Lu, Chuanxin Tang, Bo An, Shuicheng Yan

专题命中 视频扩散模型 :video generation(title,abstract);video diffusion(abstract);分类 cs.CV

Comments Project Page: https://memoavatar.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.01821 2024-12-03 cs.CV 83%

World-consistent Video Diffusion with Explicit 3D Modeling

Qihang Zhang, Shuangfei Zhai, Miguel Angel Bautista, Kevin Miao, Alexander Toshev, Joshua Susskind, Jiatao Gu

专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);分类 cs.CV

Comments 16 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.01343 2024-12-03 cs.CV 83%

MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models

Xiaomin Li, Xu Jia, Qinghe Wang, Haiwen Diao, Mengmeng Ge, Pengxiang Li, You He, Huchuan Lu

专题命中 视频扩散模型 :video diffusion(title);video generation(abstract);text-to-video(abstract);分类 cs.CV

Comments Accepted by ACM MM 2024, code will be released in https://github.com/XiaominLi1997/MoTrans

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.00773 2024-12-03 cs.CV cs.AI 83%

DIVD: Deblurring with Improved Video Diffusion Model

Haoyang Long, Yan Wang, Wendong Wang

专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.09153 2024-11-15 cs.CV cs.RO 83%

VidMan: Exploiting Implicit Dynamics from Video Diffusion Model for Effective Robot Manipulation

Youpeng Wen, Junfan Lin, Yi Zhu, Jianhua Han, Hang Xu, Shen Zhao, Xiaodan Liang

专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);分类 cs.CV

Comments Accepted to NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.14864 2024-11-13 cs.CV 83%

Video Diffusion Models are Training-free Motion Interpreter and Controller

Zeqi Xiao, Yifan Zhou, Shuai Yang, Xingang Pan

专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);分类 cs.CV

Comments Accepted by NeurIPS 2024. Project Page: https://xizaoqu.github.io/moft/

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.04928 2024-11-08 cs.CV cs.AI cs.GR 83%

DimensionX: Create Any 3D and 4D Scenes from a Single Image with Controllable Video Diffusion

Wenqiang Sun, Shuo Chen, Fangfu Liu, Zilong Chen, Yueqi Duan, Jun Zhang, Yikai Wang

专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);分类 cs.CV

Comments Project Page: https://chenshuo20.github.io/DimensionX/

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.15735 2024-11-07 cs.CV cs.AI 83%

Identifying and Solving Conditional Image Leakage in Image-to-Video Diffusion Model

Min Zhao, Hongzhou Zhu, Chendong Xiang, Kaiwen Zheng, Chongxuan Li, Jun Zhu

专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);分类 cs.CV

Comments NeurIPS 2024. Project page: https://cond-image-leak.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.00225 2024-11-05 cs.CV 83%

Fashion-VDM: Video Diffusion Model for Virtual Try-On

Johanna Karras, Yingwei Li, Nan Liu, Luyang Zhu, Innfarn Yoo, Andreas Lugmayr, Chris Lee, Ira Kemelmacher-Shlizerman

专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);分类 cs.CV

Comments Accepted to SIGGRAPH Asia 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.01647 2024-11-05 cs.CV cs.AI 83%

Optical Flow Representation Alignment Mamba Diffusion Model for Medical Video Generation

Zhenbin Wang, Lei Zhang, Lituan Wang, Minjuan Zhu, Zhenwei Zhang

专题命中 视频扩散模型 :video generation(title,abstract);video diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.01171 2024-11-05 cs.CV cs.AI 83%

Fast and Memory-Efficient Video Diffusion Using Streamlined Inference

Zheng Zhan, Yushu Wu, Yifan Gong, Zichong Meng, Zhenglun Kong, Changdi Yang, Geng Yuan, Pu Zhao, Wei Niu, Yanzhi Wang

专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);分类 cs.CV

Comments Accepted to NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.19593 2024-11-01 cs.CV 83%

Frame by Familiar Frame: Understanding Replication in Video Diffusion Models

Aimon Rahman, Malsha V. Perera, Vishal M. Patel

专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.20674 2024-10-23 cs.CV 83%

4Diffusion: Multi-view Video Diffusion Model for 4D Generation

Haiyu Zhang, Xinyuan Chen, Yaohui Wang, Xihui Liu, Yunhong Wang, Yu Qiao

专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);分类 cs.CV

Comments NeurIPS 2024. Project Page: https://aejion.github.io/4diffusion/

详情

展开后加载摘要…

URL PDF HTML 收藏