arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

视频大模型

视频理解、视频生成、视频语言模型和时序视觉推理。

共收录 6781 信号源:cs.CV, eess.IV, cs.MM

1. 视频扩散模型 1305 篇

2508.09667 2025-08-14 cs.CV 79%

GSFixer: Improving 3D Gaussian Splatting with Reference-Guided Video Diffusion Priors

Xingyilang Yin, Qi Zhang, Jiahao Chang, Ying Feng, Qingnan Fan, Xi Yang, Chi-Man Pun, Huaqi Zhang, Xiaodong Cun

机构 * University of Macau(澳门大学) VIVO CUHKSZ(香港中文大学) Xidian University(西安电子科技大学) GVC Lab, Great Bay University(大澳大学GVC实验室)

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08978 2025-08-13 cs.CV 79%

TaoCache: Structure-Maintained Video Generation Acceleration

Zhentao Fan, Zongzuo Wang, Weiwei Zhang

机构 * Huawei Inc.(华为公司)

专题命中 视频扩散模型 :video generation(title);video diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.08333 2025-08-12 cs.CV 79%

DAViD: Modeling Dynamic Affordance of 3D Objects Using Pre-trained Video Diffusion Models

Hyeonwoo Kim, Sangwon Baik, Hanbyul Joo

机构 * Seoul National University(首尔国立大学)

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments Project Page: https://snuvclab.github.io/david/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17539 2025-08-12 cs.CV 79%

Generating, Fast and Slow: Scalable Parallel Video Generation with Video Interface Networks

Bhishma Dedhia, David Bourgin, Krishna Kumar Singh, Yuheng Li, Yan Kang, Zhan Xu, Niraj K. Jha, Yuchen Liu

机构 * Princeton University(普林斯顿大学) Adobe Research(Adobe研究)

专题命中 视频扩散模型 :video generation(title);long video(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06392 2025-08-11 cs.CV 79%

FVGen: Accelerating Novel-View Synthesis with Adversarial Video Diffusion Distillation

Wenbin Teng, Gonglin Chen, Haiwei Chen, Yajie Zhao

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04467 2025-08-07 cs.CV 79%

4DVD: Cascaded Dense-view Video Diffusion Model for High-quality 4D Content Generation

Shuzhou Yang, Xiaodong Cun, Xiaoyu Li, Yaowei Li, Jian Zhang

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03123 2025-08-07 cs.CV 79%

Dual-Expert Consistency Model for Efficient and High-Quality Video Generation

Zhengyao Lv, Chenyang Si, Tianlin Pan, Zhaoxi Chen, Kwan-Yee K. Wong, Yu Qiao, Ziwei Liu

机构 * Nanjing University(南京大学) The University of Hong Kong(香港大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) University of Chinese Academy of Sciences(中国科学院大学) S-Lab, Nanyang Technological University(南洋理工大学S实验室)

专题命中 视频扩散模型 :video generation(title);video diffusion(abstract);分类 cs.CV

Comments This paper has been accepted to ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.08331 2025-08-07 cs.CV 79%

Go-with-the-Flow: Motion-Controllable Video Diffusion Models Using Real-Time Warped Noise

Ryan Burgert, Yuancheng Xu, Wenqi Xian, Oliver Pilarski, Pascal Clausen, Mingming He, Li Ma, Yitong Deng, Lingxiao Li, Mohsen Mousavi, Michael Ryoo, Paul Debevec, Ning Yu

机构 * Netflix Eyeline Studios(NetflixEyeline Studios) Netflix Stony Brook University(斯通布罗克大学) University of Maryland(马里兰大学) Stanford University(斯坦福大学)

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments Accepted to CVPR'25 as Oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17350 2025-08-06 cs.CV 79%

Decouple and Track: Benchmarking and Improving Video Diffusion Transformers for Motion Transfer

Qingyu Shi, Jianzong Wu, Jinbin Bai, Jiangning Zhang, Lu Qi, Yunhai Tong, Xiangtai Li

机构 * PKU(北京大学) NTU(国立新加坡大学) NUS(新加坡国立大学) ZJU(浙江大学) UC Merced(加州大学默塞德分校)

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04847 2025-08-05 cs.CV 79%

HumanDiT: Pose-Guided Diffusion Transformer for Long-form Human Motion Video Generation

Qijun Gan, Yi Ren, Chen Zhang, Zhenhui Ye, Pan Xie, Xiang Yin, Zehuan Yuan, Bingyue Peng, Jianke Zhu

机构 * Zhejiang University(浙江大学) ByteDance(字节跳动)

专题命中 视频扩散模型 :video generation(title,abstract);分类 cs.CV

Comments https://agnjason.github.io/HumanDiT-page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.03140 2025-07-29 cs.CV 79%

Model Reveals What to Cache: Profiling-Based Feature Reuse for Video Diffusion Models

Xuran Ma, Yexin Liu, Yaofu Liu, Xianfeng Wu, Mingzhe Zheng, Zihao Wang, Ser-Nam Lim, Harry Yang

机构 * Hong Kong University of Science and Technology(香港科技大学) Everlyn AI University of Central Florida(佛罗里达中央大学)

专题命中 视频扩散模型 :video diffusion(title);video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19789 2025-07-29 cs.CV 79%

TransFlow: Motion Knowledge Transfer from Video Diffusion Models to Video Salient Object Detection

Suhwan Cho, Minhyeok Lee, Jungho Lee, Sunghun Yang, Sangyoun Lee

机构 * GenGenAI Yonsei University(延世大学)

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments ICCVW 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16341 2025-07-23 cs.CV 79%

Navigating Large-Pose Challenge for High-Fidelity Face Reenactment with Video Diffusion Model

Mingtao Guo, Guanyu Xing, Yanci Zhang, Yanli Liu

机构 * National Key Laboratory of Fundamental Science on Synthetic Vision, Sichuan University, Chengdu, 610065, China(合成视觉基础科学国家重点实验室,四川大学,成都,610065,中国) School of Cyber Science and Engineering, Sichuan University, Chengdu, 610065, China(网络科学与工程学院,四川大学,成都,610065,中国) College of Computer Science, Sichuan University, Chengdu, 610065, China(计算机科学学院,四川大学,成都,610065,中国)

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.00704 2025-07-22 cs.GR cs.CV 79%

Controllable Weather Synthesis and Removal with Video Diffusion Models

Chih-Hao Lin, Zian Wang, Ruofan Liang, Yuxuan Zhang, Sanja Fidler, Shenlong Wang, Zan Gojcic

机构 * NVIDIA University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) University of Toronto(多伦多大学) Vector Institute(向量研究所)

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments International Conference on Computer Vision (ICCV) 2025, Project Website: https://research.nvidia.com/labs/toronto-ai/WeatherWeaver/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11992 2025-07-14 cs.CV 79%

SpatialCrafter: Unleashing the Imagination of Video Diffusion Models for Scene Reconstruction from Limited Observations

Songchun Zhang, Huiyao Xu, Sitong Guo, Zhongwei Xie, Hujun Bao, Weiwei Xu, Changqing Zou

机构 * ZJU(浙江大学) HKUST(香港科技大学) Zhejiang Lab(浙江实验室)

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments Accepted by ICCV 2025. 12 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05678 2025-07-09 cs.CV 79%

LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion

Yisu Zhang, Chenjie Cao, Chaohui Yu, Jianke Zhu

机构 * Zhejiang University(浙江大学) DAMO Academy, Alibaba Group(阿里巴巴集团达摩院) Hupan Lab(虎扑实验室)

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02813 2025-07-04 cs.CV 79%

LangScene-X: Reconstruct Generalizable 3D Language-Embedded Scenes with TriMap Video Diffusion

Fangfu Liu, Hao Li, Jiawei Chi, Hanyang Wang, Minghui Yang, Fudong Wang, Yueqi Duan

机构 * Tsinghua University(清华大学) NTU(国立科技大学) Ant Group(蚂蚁集团)

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments Project page: https://liuff19.github.io/LangScene-X

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.04814 2025-07-02 cs.CV cs.LG 79%

Lifelong Learning of Video Diffusion Models From a Single Video Stream

Jason Yoo, Yingchen He, Saeid Naderiparizi, Dylan Green, Gido M. van de Ven, Geoff Pleiss, Frank Wood

机构 * University of British Columbia(不列颠哥伦比亚大学) KU Leuven(鲁文大学) Vector Institute(向量研究所) Amii(阿米研究所)

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments Video samples are available here: https://drive.google.com/drive/folders/1CsmWqug-CS7I6NwGDvHsEN9FqN2QzspN

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09229 2025-06-26 cs.CV 79%

Cross-Frame Representation Alignment for Fine-Tuning Video Diffusion Models

Sungwon Hwang, Hyojin Jang, Kinam Kim, Minho Park, Jaegul Choo

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments Project page: https://crepavideo.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.16767 2025-06-26 cs.CV cs.AI cs.GR 79%

ReconX: Reconstruct Any Scene from Sparse Views with Video Diffusion Model

Fangfu Liu, Wenqiang Sun, Hanyang Wang, Yikai Wang, Haowen Sun, Junliang Ye, Jun Zhang, Yueqi Duan

机构 * Department of Electronic Engineering, Tsinghua University(电子工程系,清华大学) Department of Electronic and Computer Engineering, Hong Kong University of Science and Technology(电子与计算机工程系,香港科学与技术大学) Department of Computer Science, Tsinghua University(计算机科学系,清华大学) School of Artificial Intelligence, Beijing Normal University(人工智能学院,北京师范大学) Department of Automation, Tsinghua University(自动化系,清华大学)

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments Project page: https://liuff19.github.io/ReconX

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.18792 2025-06-24 cs.CV 79%

ViDAR: Video Diffusion-Aware 4D Reconstruction From Monocular Inputs

Michal Nazarczuk, Sibi Catley-Chandar, Thomas Tanay, Zhensong Zhang, Gregory Slabaugh, Eduardo Pérez-Pellitero

机构 * Huawei Noah’s Ark Lab(华为诺亚实验室) Queen Mary University of London(伦敦大学女王学院)

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17705 2025-06-24 cs.CV 79%

DreamJourney: Perpetual View Generation with Video Diffusion Models

Bo Pan, Yang Chen, Yingwei Pan, Ting Yao, Wei Chen, Tao Mei

机构 * State Key Lab of CAD&CG, Zhejiang University(浙江大学CAD与CG国家重点实验室) Laboratory of Art and Archaeology Image(艺术与考古图像实验室)

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09665 2025-06-17 cs.GR cs.CV 79%

VideoMat: Extracting PBR Materials from Video Diffusion Models

Jacob Munkberg, Zian Wang, Ruofan Liang, Tianchang Shen, Jon Hasselgren

机构 * NVIDIA Sweden(NVIDIA瑞典分公司) NVIDIA , University of Toronto , Vector Institute Canada(NVIDIA、多伦多大学、向量研究所加拿大) NVIDIA University of Toronto(多伦多大学) Vector Institute(向量研究所)

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments Project website: https://nvlabs.github.io/videomat/

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07698 2025-06-10 cs.CV cs.AI 79%

NOVA3D: Normal Aligned Video Diffusion Model for Single Image to 3D Generation

Yuxiao Yang, Peihao Li, Yuhong Zhang, Junzhe Lu, Xianglong He, Minghan Qin, Weitao Wang, Haoqian Wang

机构 * Tsinghua University(清华大学)

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments 8 pages, 7 figures, accepted by ICME 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.01493 2025-06-10 cs.CV 79%

Learning Temporally Consistent Video Depth from Video Diffusion Priors

Jiahao Shao, Yuanbo Yang, Hongyu Zhou, Youmin Zhang, Yujun Shen, Vitor Guizilini, Yue Wang, Matteo Poggi, Yiyi Liao

机构 * Zhejiang University(浙江大学) University of Bologna(博洛尼亚大学) University of Southern California(南加州大学) Ant Group(蚂蚁集团) Toyota Research Institute(丰田研究院) Rock Universe AI

专题命中 视频扩散模型 :video diffusion(title);long video(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04648 2025-06-09 cs.CV 79%

FPSAttention: Training-Aware FP8 and Sparsity Co-Design for Fast Video Diffusion

Akide Liu, Zeyu Zhang, Zhexin Li, Xuehai Bai, Yizeng Han, Jiasheng Tang, Yuanjie Xing, Jichao Wu, Mingyang Yang, Weihua Chen, Jiahao He, Yuanyu He, Fan Wang, Gholamreza Haffari, Bohan Zhuang

机构 * Monash University(墨尔本大学) DAMO Academy, Alibaba Group(阿里云图学院) ZIP Lab, Zhejiang University(浙江大学ZIP实验室) Hupan Lab(汇磐实验室)

专题命中 视频扩散模型 :video diffusion(title);video generation(abstract);分类 cs.CV

Comments Project Page: https://fps.ziplab.co

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04225 2025-06-05 cs.CV 79%

Voyager: Long-Range and World-Consistent Video Diffusion for Explorable 3D Scene Generation

Tianyu Huang, Wangguandong Zheng, Tengfei Wang, Yuhao Liu, Zhenwei Wang, Junta Wu, Jie Jiang, Hui Li, Rynson W. H. Lau, Wangmeng Zuo, Chunchao Guo

机构 * Harbin Institute of Technology China(哈尔滨工业大学) Southeast University China(东南大学) Tencent Hunyuan China(腾讯幻境) City University of Hong Kong China(香港城市大学)

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01454 2025-06-03 cs.CV 79%

DiffuseSlide: Training-Free High Frame Rate Video Generation Diffusion

Geunmin Hwang, Hyun-kyu Ko, Younghyun Kim, Seungryong Lee, Eunbyung Park

机构 * RECON Labs Inc.(RECON实验室公司) Department of Artificial Intelligence, Yonsei University(延世大学人工智能系) Department of Artificial Intelligence, Sungkyunkwan University(成均馆大学人工智能系) Department of Electrical and Computer Engineering, Sungkyunkwan University(成均馆大学电气与计算机工程系)

专题命中 视频扩散模型 :video generation(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.24521 2025-06-02 cs.CV 79%

UniGeo: Taming Video Diffusion for Unified Consistent Geometry Estimation

Yang-Tian Sun, Xin Yu, Zehuan Huang, Yi-Hua Huang, Yuan-Chen Guo, Ziyi Yang, Yan-Pei Cao, Xiaojuan Qi

机构 * The University of Hong Kong(香港大学) Beihang University(北京航空航天大学) VAST

专题命中 视频扩散模型 :video diffusion(title);video generation(abstract);分类 cs.CV

Comments Project page: https://sunyangtian.github.io/UniGeo-web/

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.16003 2025-05-13 cs.CV physics.ao-ph 79%

Improving Tropical Cyclone Forecasting With Video Diffusion Models

Zhibo Ren, Pritthijit Nath, Pancham Shukla

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments Recommended for spotlight presentation at the ICLR 2025 workshop on Tackling Climate Change with Machine Learning. 7 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏