arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

视频大模型

视频理解、视频生成、视频语言模型和时序视觉推理。

共收录 6781 信号源:cs.CV, eess.IV, cs.MM

1. 视频扩散模型 1305 篇

2407.21705 2025-03-17 cs.CV 79%

Tora: Trajectory-oriented Diffusion Transformer for Video Generation

Zhenghao Zhang, Junchao Liao, Menghao Li, Zuozhuo Dai, Bingxue Qiu, Siyu Zhu, Long Qin, Weizhi Wang

专题命中 视频扩散模型 :video generation(title,abstract);分类 cs.CV

Comments CVPR 2025 Conference Proceedings

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10626 2025-03-14 cs.CV cs.AI cs.LG cs.RO 79%

NIL: No-data Imitation Learning by Leveraging Pre-trained Video Diffusion Models

Mert Albaba, Chenhao Li, Markos Diomataris, Omid Taheri, Andreas Krause, Michael Black

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10592 2025-03-14 cs.CV 79%

CameraCtrl II: Dynamic Scene Exploration via Camera-controlled Video Diffusion Models

Hao He, Ceyuan Yang, Shanchuan Lin, Yinghao Xu, Meng Wei, Liangke Gui, Qi Zhao, Gordon Wetzstein, Lu Jiang, Hongsheng Li

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments Project page: https://hehao13.github.io/Projects-CameraCtrl-II/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09595 2025-03-13 cs.CV 79%

PISA Experiments: Exploring Physics Post-Training for Video Diffusion Models by Watching Stuff Drop

Chenyu Li, Oscar Michel, Xichen Pan, Sainan Liu, Mike Roberts, Saining Xie

专题命中 视频扩散模型 :video diffusion(title);video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09566 2025-03-13 cs.CV 79%

TPDiff: Temporal Pyramid Video Diffusion Model

Lingmin Ran, Mike Zheng Shou

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments Project page: https://showlab.github.io/TPDiff/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09344 2025-03-13 cs.CV 79%

Unified Dense Prediction of Video Diffusion

Lehan Yang, Lu Qi, Xiangtai Li, Sheng Li, Varun Jampani, Ming-Hsuan Yang

专题命中 视频扩散模型 :video diffusion(title);video generation(abstract);分类 cs.CV

Comments Accepted by CVPR2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.05082 2025-03-10 cs.CV 79%

Taming Video Diffusion Prior with Scene-Grounding Guidance for 3D Gaussian Splatting from Sparse Inputs

Yingji Zhong, Zhihao Li, Dave Zhenyu Chen, Lanqing Hong, Dan Xu

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments Accepted by CVPR2025. The project page is available at https://zhongyingji.github.io/guidevd-3dgs/

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.15259 2025-03-04 cs.CV cs.AI 79%

StarVid: Enhancing Semantic Alignment in Video Diffusion Models via Spatial and SynTactic Guided Attention Refocusing

Yuanhang Li, Qi Mao, Lan Chen, Zhen Fang, Lei Tian, Xinyan Xiao, Libiao Jin, Hua Wu

专题命中 视频扩散模型 :video diffusion(title);text-to-video(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.19894 2025-03-03 cs.CV 79%

High-Fidelity Relightable Monocular Portrait Animation with Lighting-Controllable Video Diffusion Model

Mingtao Guo, Guanyu Xing, Yanli Liu

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.20307 2025-02-28 cs.CV 79%

Mobius: Text to Seamless Looping Video Generation via Latent Shift

Xiuli Bi, Jianfei Yuan, Bo Liu, Yong Zhang, Xiaodong Cun, Chi-Man Pun, Bin Xiao

专题命中 视频扩散模型 :video generation(title);video diffusion(abstract);分类 cs.CV

Comments Project page: https://mobius-diffusion.github.io/ ; GitHub repository: https://github.com/YisuiTT/Mobius

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.02540 2025-02-25 cs.CV 79%

ViDiT-Q: Efficient and Accurate Quantization of Diffusion Transformers for Image and Video Generation

Tianchen Zhao, Tongcheng Fang, Haofeng Huang, Enshu Liu, Rui Wan, Widyadewi Soedarmadji, Shiyao Li, Zinan Lin, Guohao Dai, Shengen Yan, Huazhong Yang, Xuefei Ning, Yu Wang

专题命中 视频扩散模型 :video generation(title,abstract);分类 cs.CV

Comments Accepted at ICLR 2025, Project Page: https://a-suozhang.xyz/viditq.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.13329 2025-02-24 cs.CV 79%

Generative Video Diffusion for Unseen Novel Semantic Video Moment Retrieval

Dezhao Luo, Shaogang Gong, Jiabo Huang, Hailin Jin, Yang Liu

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments AAAI-25

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.03496 2025-02-20 eess.IV cs.GR 79%

FreqPrior: Improving Video Diffusion Models with Frequency Filtering Gaussian Noise

Yunlong Yuan, Yuanfan Guo, Chunwei Wang, Wei Zhang, Hang Xu, Li Zhang

专题命中 视频扩散模型 :video diffusion(title);video generation(abstract);分类 eess.IV

Comments ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11515 2025-02-18 cs.CV 79%

SayAnything: Audio-Driven Lip Synchronization with Conditional Video Diffusion

Junxian Ma, Shiwen Wang, Jian Yang, Junyi Hu, Jian Liang, Guosheng Lin, Jingbo chen, Kai Li, Yu Meng

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10841 2025-02-18 cs.CV 79%

SkyReels-A1: Expressive Portrait Animation in Video Diffusion Transformers

Di Qiu, Zhengcong Fei, Rui Wang, Jialin Bai, Changqian Yu, Mingyuan Fan, Guibin Chen, Xiang Wen

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.06155 2025-02-18 cs.CV 79%

Efficient-vDiT: Efficient Video Diffusion Transformers With Attention Tile

Hangliang Ding, Dacheng Li, Runlong Su, Peiyuan Zhang, Zhijie Deng, Ion Stoica, Hao Zhang

专题命中 视频扩散模型 :video diffusion(title);video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.06782 2025-02-13 cs.CV 79%

Lumina-Video: Efficient and Flexible Video Generation with Multi-scale Next-DiT

Dongyang Liu, Shicheng Li, Yutong Liu, Zhen Li, Kai Wang, Xinyue Li, Qi Qin, Yufei Liu, Yi Xin, Zhongyu Li, Bin Fu, Chenyang Si, Yuewen Cao, Conghui He, Ziwei Liu, Yu Qiao, Qibin Hou, Hongsheng Li, Peng Gao

专题命中 视频扩散模型 :video generation(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.16050 2025-01-29 cs.CV cs.AI 79%

Label-Efficient Data Augmentation with Video Diffusion Models for Guidewire Segmentation in Cardiac Fluoroscopy

Shaoyan Pan, Yikang Liu, Lin Zhao, Eric Z. Chen, Xiao Chen, Terrence Chen, Shanhui Sun

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments AAAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.17470 2025-01-03 cs.CV cs.AI cs.LG 79%

Towards Precise Scaling Laws for Video Diffusion Transformers

Yuanyang Yin, Yaqi Zhao, Mingwu Zheng, Ke Lin, Jiarong Ou, Rui Chen, Victor Shea-Jay Huang, Jiahao Wang, Xin Tao, Pengfei Wan, Di Zhang, Baoqun Yin, Wentao Zhang, Kun Gai

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.18613 2024-12-20 cs.CV 79%

CAT4D: Create Anything in 4D with Multi-View Video Diffusion Models

Rundi Wu, Ruiqi Gao, Ben Poole, Alex Trevithick, Changxi Zheng, Jonathan T. Barron, Aleksander Holynski

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments Project page: https://cat-4d.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.01476 2024-12-19 cs.CV 79%

DreamPhysics: Learning Physics-Based 3D Dynamics with Video Diffusion Priors

Tianyu Huang, Haoze Zhang, Yihan Zeng, Zhilu Zhang, Hui Li, Wangmeng Zuo, Rynson W. H. Lau

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments Accepted by AAAI 2025. Codes are released at: https://github.com/tyhuang0428/DreamPhysics

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.11710 2024-12-17 cs.CV cs.AI 79%

Re-Attentional Controllable Video Diffusion Editing

Yuanzhi Wang, Yong Li, Mengyi Liu, Xiaoya Zhang, Xin Liu, Zhen Cui, Antoni B. Chan

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments Accepted by AAAI 2025. Codes are released at: https://github.com/mdswyz/ReAtCo

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.11402 2024-12-17 cs.CV 79%

Video Diffusion Models are Strong Video Inpainter

Minhyeok Lee, Suhwan Cho, Chajin Shin, Jungho Lee, Sunghun Yang, Sangyoun Lee

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments Accepted to AAAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.05899 2024-12-10 cs.CV 79%

Accelerating Video Diffusion Models via Distribution Matching

Yuanzhi Zhu, Hanshu Yan, Huan Yang, Kai Zhang, Junnan Li

专题命中 视频扩散模型 :video diffusion(title);video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.05355 2024-12-10 cs.CV cs.AI 79%

MotionShop: Zero-Shot Motion Transfer in Video Diffusion Models with Mixture of Score Guidance

Hidir Yesiltepe, Tuna Han Salih Meral, Connor Dunlop, Pinar Yanardag

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments Project page: https://motionshop-diffusion.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.15957 2024-12-05 cs.CV 79%

CamI2V: Camera-Controlled Image-to-Video Diffusion Model

Guangcong Zheng, Teng Li, Rui Jiang, Yehao Lu, Tao Wu, Xi Li

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.18664 2024-12-02 cs.CV 79%

Spatiotemporal Skip Guidance for Enhanced Video Diffusion Sampling

Junha Hyung, Kinam Kim, Susung Hong, Min-Jung Kim, Jaegul Choo

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments project page: https://junhahyung.github.io/STGuidance

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.12822 2024-11-26 cs.CV cs.LG 79%

AVID: Adapting Video Diffusion Models to World Models

Marc Rigter, Tarun Gupta, Agrin Hilmkil, Chao Ma

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments Project Webpage: https://sites.google.com/view/avid-world-model-adapters/home

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.14208 2024-11-22 cs.CV 79%

Novel View Extrapolation with Video Diffusion Priors

Kunhao Liu, Ling Shao, Shijian Lu

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.07472 2024-11-22 cs.CV 79%

4Real: Towards Photorealistic 4D Scene Generation via Video Diffusion Models

Heng Yu, Chaoyang Wang, Peiye Zhuang, Willi Menapace, Aliaksandr Siarohin, Junli Cao, Laszlo A Jeni, Sergey Tulyakov, Hsin-Ying Lee

专题命中 视频扩散模型 :video diffusion(title);video generation(abstract);分类 cs.CV

Comments NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏