arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

视频大模型

视频理解、视频生成、视频语言模型和时序视觉推理。

共收录 6781 信号源:cs.CV, eess.IV, cs.MM

1. 视频扩散模型 1305 篇

2505.05475 2025-05-09 cs.CV 79%

SVAD: From Single Image to 3D Avatar via Synthetic Data Generation with Video Diffusion and Data Augmentation

Yonwoo Choi

机构 * SECERN AI

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments Accepted by CVPR 2025 SyntaGen Workshop, Project Page: https://yc4ny.github.io/SVAD/

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.14423 2025-05-09 cs.CV 79%

PhysFlow: Unleashing the Potential of Multi-modal Foundation Models and Video Diffusion for 4D Dynamic Physical Scene Simulation

Zhuoman Liu, Weicai Ye, Yan Luximon, Pengfei Wan, Di Zhang

机构 * The Hong Kong Polytechnic University(香港理工大学) Kuaishou Technology(快手科技)

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments CVPR 2025. Homepage: https://zhuomanliu.github.io/PhysFlow/

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.19614 2025-04-29 cs.CV 79%

DiVE: Efficient Multi-View Driving Scenes Generation Based on Video Diffusion Transformer

Junpeng Jiang, Gangyi Hong, Miao Zhang, Hengtong Hu, Kun Zhan, Rui Shao, Liqiang Nie

机构 * Harbin Institute of Technology(哈尔滨工业大学) Li Auto Inc.(Li汽车公司) Tsinghua University(清华大学)

专题命中 视频扩散模型 :video diffusion(title);video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01776 2025-04-29 cs.CV cs.LG 79%

Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity

Haocheng Xi, Shuo Yang, Yilong Zhao, Chenfeng Xu, Muyang Li, Xiuyu Li, Yujun Lin, Han Cai, Jintao Zhang, Dacheng Li, Jianfei Chen, Ion Stoica, Kurt Keutzer, Song Han

专题命中 视频扩散模型 :video diffusion(title);video generation(abstract);分类 cs.CV

Comments 17 pages, 11 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14535 2025-04-22 cs.CV 79%

FlowLoss: Dynamic Flow-Conditioned Loss Strategy for Video Diffusion Models

Kuanting Wu, Kei Ota, Asako Kanezaki

机构 * Science Tokyo(科学东京) Mitsubishi Electric(三菱电机)

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12027 2025-04-18 cs.CV 79%

Understanding Attention Mechanism in Video Diffusion Models

Bingyan Liu, Chengyu Wang, Tongtong Su, Huan Ten, Jun Huang, Kailing Guo, Kui Jia

专题命中 视频扩散模型 :video diffusion(title);text-to-video(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12259 2025-04-17 cs.CV 79%

VGDFR: Diffusion-based Video Generation with Dynamic Latent Frame Rate

Zhihang Yuan, Rui Xie, Yuzhang Shang, Hanling Zhang, Siyuan Wang, Shengen Yan, Guohao Dai, Yu Wang

专题命中 视频扩散模型 :video generation(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.10001 2025-04-17 cs.CV 79%

GaussVideoDreamer: 3D Scene Generation with Video Diffusion and Inconsistency-Aware Gaussian Splatting

Junlin Hao, Peiheng Wang, Haoyang Wang, Xinggong Zhang, Zongming Guo

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.11427 2025-04-16 cs.CV 79%

NormalCrafter: Learning Temporally Consistent Normals from Video Diffusion Priors

Yanrui Bin, Wenbo Hu, Haoyuan Wang, Xinya Chen, Bing Wang

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments 9 pages, 6 figures, Project Page: https://normalcrafter.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.10317 2025-04-15 cs.CV 79%

Analysis of Attention in Video Diffusion Transformers

Yuxin Wen, Jim Wu, Ajay Jain, Tom Goldstein, Ashwinee Panda

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.05763 2025-04-15 cs.CV 79%

StarGen: A Spatiotemporal Autoregression Framework with Video Diffusion Model for Scalable and Controllable Scene Generation

Shangjin Zhai, Zhichao Ye, Jialin Liu, Weijian Xie, Jiaqi Hu, Zhen Peng, Hua Xue, Danpeng Chen, Xiaomeng Wang, Lei Yang, Nan Wang, Haomin Liu, Guofeng Zhang

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.08542 2025-04-14 cs.CV 79%

Discriminator-Free Direct Preference Optimization for Video Diffusion

Haoran Cheng, Qide Dong, Liang Peng, Zhizhou Sha, Weiguo Feng, Jinghui Xie, Zhao Song, Shilei Wen, Xiaofei He, Boxi Wu

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments arXiv admin note: text overlap with arXiv:2412.14167 by other authors

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.17459 2025-04-14 cs.CV cs.AI 79%

WF-VAE: Enhancing Video VAE by Wavelet-Driven Energy Flow for Latent Video Diffusion Model

Zongjian Li, Bin Lin, Yang Ye, Liuhan Chen, Xinhua Cheng, Shenghai Yuan, Li Yuan

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments 8 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.11785 2025-04-07 cs.CV 79%

InterDyn: Controllable Interactive Dynamics with Video Diffusion Models

Rick Akkerman, Haiwen Feng, Michael J. Black, Dimitrios Tzionas, Victoria Fernández Abrevaya

专题命中 视频扩散模型 :video diffusion(title);video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.02436 2025-04-04 cs.CV 79%

SkyReels-A2: Compose Anything in Video Diffusion Transformers

Zhengcong Fei, Debang Li, Di Qiu, Jiahua Wang, Yikun Dou, Rui Wang, Jingtao Xu, Mingyuan Fan, Guibin Chen, Yang Li, Yahui Zhou

专题命中 视频扩散模型 :video diffusion(title);video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.01956 2025-04-04 cs.CV 79%

VideoScene: Distilling Video Diffusion Model to Generate 3D Scenes in One Step

Hanyang Wang, Fangfu Liu, Jiawei Chi, Yueqi Duan

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments Accepted by CVPR 2025; Project Page: https://hanyang-21.github.io/VideoScene

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.01204 2025-04-03 cs.GR cs.CV 79%

Articulated Kinematics Distillation from Video Diffusion Models

Xuan Li, Qianli Ma, Tsung-Yi Lin, Yongxin Chen, Chenfanfu Jiang, Ming-Yu Liu, Donglai Xiang

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18583 2025-04-03 cs.CV 79%

Adapting Video Diffusion Models for Time-Lapse Microscopy

Alexander Holmberg, Nils Mechtel, Wei Ouyang

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.14485 2025-04-03 cs.GR cs.CV 79%

Lux Post Facto: Learning Portrait Performance Relighting with Conditional Video Diffusion and a Hybrid Dataset

Yiqun Mei, Mingming He, Li Ma, Julien Philip, Wenqi Xian, David M George, Xueming Yu, Gabriel Dedic, Ahmet Levent Taşel, Ning Yu, Vishal M. Patel, Paul Debevec

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.15364 2025-04-03 cs.CV 79%

NVS-Solver: Video Diffusion Model as Zero-Shot Novel View Synthesizer

Meng You, Zhiyu Zhu, Hui Liu, Junhui Hou

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.21082 2025-03-28 cs.CV 79%

Can Video Diffusion Model Reconstruct 4D Geometry?

Jinjie Mai, Wenxuan Zhu, Haozhe Liu, Bing Li, Cheng Zheng, Jürgen Schmidhuber, Bernard Ghanem

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.20268 2025-03-27 cs.CV 79%

EGVD: Event-Guided Video Diffusion Model for Physically Realistic Large-Motion Frame Interpolation

Ziran Zhang, Xiaohui Li, Yihao Liu, Yujin Wang, Yueting Chen, Tianfan Xue, Shi Guo

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.07761 2025-03-26 cs.CV 79%

Repurposing Pre-trained Video Diffusion Models for Event-based Video Interpolation

Jingxi Chen, Brandon Y. Feng, Haoming Cai, Tianfu Wang, Levi Burner, Dehao Yuan, Cornelia Fermuller, Christopher A. Metzler, Yiannis Aloimonos

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments Accepted to CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16396 2025-03-26 cs.CV 79%

SV4D 2.0: Enhancing Spatio-Temporal Consistency in Multi-View Video Diffusion for High-Quality 4D Generation

Chun-Han Yao, Yiming Xie, Vikram Voleti, Huaizu Jiang, Varun Jampani

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments Project page: https://sv4d20.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15851 2025-03-26 cs.CV 79%

Zero-1-to-A: Zero-Shot One Image to Animatable Head Avatars Using Video Diffusion

Zhenglin Zhou, Fan Ma, Hehe Fan, Tat-Seng Chua

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments Accepted by CVPR 2025, project page: https://zhenglinzhou.github.io/Zero-1-to-A/

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.18590 2025-03-25 cs.CV cs.GR 79%

DiffusionRenderer: Neural Inverse and Forward Rendering with Video Diffusion Models

Ruofan Liang, Zan Gojcic, Huan Ling, Jacob Munkberg, Jon Hasselgren, Zhi-Hao Lin, Jun Gao, Alexander Keller, Nandita Vijaykumar, Sanja Fidler, Zian Wang

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments CVPR 2025; project page: research.nvidia.com/labs/toronto-ai/DiffusionRenderer/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16068 2025-03-21 cs.CV 79%

PoseTraj: Pose-Aware Trajectory Control in Video Diffusion

Longbin Ji, Lei Zhong, Pengfei Wei, Changjian Li

专题命中 视频扩散模型 :video diffusion(title);video generation(abstract);分类 cs.CV

Comments Code, data and project page: https://robingg1.github.io/Pose-Traj/

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.01790 2025-03-19 cs.CV 79%

Ingredients: Blending Custom Photos with Video Diffusion Transformers

Zhengcong Fei, Debang Li, Di Qiu, Changqian Yu, Mingyuan Fan

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.19108 2025-03-19 cs.CV 79%

Timestep Embedding Tells: It's Time to Cache for Video Diffusion Model

Feng Liu, Shiwei Zhang, Xiaofeng Wang, Yujie Wei, Haonan Qiu, Yuzhong Zhao, Yingya Zhang, Qixiang Ye, Fang Wan

专题命中 视频扩散模型 :video diffusion(title);video generation(abstract);分类 cs.CV

Comments Accepted in CVPR 2025. Project: https://liewfeng.github.io/TeaCache

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13272 2025-03-18 cs.CV 79%

Generative Gaussian Splatting: Generating 3D Scenes with Video Diffusion Priors

Katja Schwarz, Norman Mueller, Peter Kontschieder

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏