arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

视频大模型

视频理解、视频生成、视频语言模型和时序视觉推理。

共收录 1298 信号源:cs.CV, eess.IV, cs.MM

1. 视频扩散模型 1298 篇

2412.16050 2025-01-29 cs.CV cs.AI 79%

Label-Efficient Data Augmentation with Video Diffusion Models for Guidewire Segmentation in Cardiac Fluoroscopy

Shaoyan Pan, Yikang Liu, Lin Zhao, Eric Z. Chen, Xiao Chen, Terrence Chen, Shanhui Sun

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments AAAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.17470 2025-01-03 cs.CV cs.AI cs.LG 79%

Towards Precise Scaling Laws for Video Diffusion Transformers

Yuanyang Yin, Yaqi Zhao, Mingwu Zheng, Ke Lin, Jiarong Ou, Rui Chen, Victor Shea-Jay Huang, Jiahao Wang, Xin Tao, Pengfei Wan, Di Zhang, Baoqun Yin, Wentao Zhang, Kun Gai

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.18613 2024-12-20 cs.CV 79%

CAT4D: Create Anything in 4D with Multi-View Video Diffusion Models

Rundi Wu, Ruiqi Gao, Ben Poole, Alex Trevithick, Changxi Zheng, Jonathan T. Barron, Aleksander Holynski

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments Project page: https://cat-4d.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.01476 2024-12-19 cs.CV 79%

DreamPhysics: Learning Physics-Based 3D Dynamics with Video Diffusion Priors

Tianyu Huang, Haoze Zhang, Yihan Zeng, Zhilu Zhang, Hui Li, Wangmeng Zuo, Rynson W. H. Lau

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments Accepted by AAAI 2025. Codes are released at: https://github.com/tyhuang0428/DreamPhysics

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.11710 2024-12-17 cs.CV cs.AI 79%

Re-Attentional Controllable Video Diffusion Editing

Yuanzhi Wang, Yong Li, Mengyi Liu, Xiaoya Zhang, Xin Liu, Zhen Cui, Antoni B. Chan

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments Accepted by AAAI 2025. Codes are released at: https://github.com/mdswyz/ReAtCo

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.11402 2024-12-17 cs.CV 79%

Video Diffusion Models are Strong Video Inpainter

Minhyeok Lee, Suhwan Cho, Chajin Shin, Jungho Lee, Sunghun Yang, Sangyoun Lee

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments Accepted to AAAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.05899 2024-12-10 cs.CV 79%

Accelerating Video Diffusion Models via Distribution Matching

Yuanzhi Zhu, Hanshu Yan, Huan Yang, Kai Zhang, Junnan Li

专题命中 视频扩散模型 :video diffusion(title);video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.05355 2024-12-10 cs.CV cs.AI 79%

MotionShop: Zero-Shot Motion Transfer in Video Diffusion Models with Mixture of Score Guidance

Hidir Yesiltepe, Tuna Han Salih Meral, Connor Dunlop, Pinar Yanardag

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments Project page: https://motionshop-diffusion.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.15957 2024-12-05 cs.CV 79%

CamI2V: Camera-Controlled Image-to-Video Diffusion Model

Guangcong Zheng, Teng Li, Rui Jiang, Yehao Lu, Tao Wu, Xi Li

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.18664 2024-12-02 cs.CV 79%

Spatiotemporal Skip Guidance for Enhanced Video Diffusion Sampling

Junha Hyung, Kinam Kim, Susung Hong, Min-Jung Kim, Jaegul Choo

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments project page: https://junhahyung.github.io/STGuidance

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.12822 2024-11-26 cs.CV cs.LG 79%

AVID: Adapting Video Diffusion Models to World Models

Marc Rigter, Tarun Gupta, Agrin Hilmkil, Chao Ma

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments Project Webpage: https://sites.google.com/view/avid-world-model-adapters/home

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.14208 2024-11-22 cs.CV 79%

Novel View Extrapolation with Video Diffusion Priors

Kunhao Liu, Ling Shao, Shijian Lu

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.07472 2024-11-22 cs.CV 79%

4Real: Towards Photorealistic 4D Scene Generation via Video Diffusion Models

Heng Yu, Chaoyang Wang, Peiye Zhuang, Willi Menapace, Aliaksandr Siarohin, Junli Cao, Laszlo A Jeni, Sergey Tulyakov, Hsin-Ying Lee

专题命中 视频扩散模型 :video diffusion(title);video generation(abstract);分类 cs.CV

Comments NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.20155 2024-11-15 cs.CV cs.GR 79%

MotionDreamer: Exploring Semantic Video Diffusion features for Zero-Shot 3D Mesh Animation

Lukas Uzolas, Elmar Eisemann, Petr Kellnhofer

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.02397 2024-11-08 cs.CV 79%

Adaptive Caching for Faster Video Generation with Diffusion Transformers

Kumara Kahatapitiya, Haozhe Liu, Sen He, Ding Liu, Menglin Jia, Chenyang Zhang, Michael S. Ryoo, Tian Xie

专题命中 视频扩散模型 :video generation(title,abstract);分类 cs.CV

Comments Project-page is available at https://adacache-dit.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.11614 2024-11-06 cs.CV 79%

Dynamic Typography: Bringing Text to Life via Video Diffusion Prior

Zichen Liu, Yihao Meng, Hao Ouyang, Yue Yu, Bolin Zhao, Daniel Cohen-Or, Huamin Qu

专题命中 视频扩散模型 :video diffusion(title);text-to-video(abstract);分类 cs.CV

Comments Our demo and code is available at: https://animate-your-word.github.io/demo/

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.06890 2024-10-29 cs.CV 79%

Motion Consistency Model: Accelerating Video Diffusion with Disentangled Motion-Appearance Distillation

Yuanhao Zhai, Kevin Lin, Zhengyuan Yang, Linjie Li, Jianfeng Wang, Chung-Ching Lin, David Doermann, Junsong Yuan, Lijuan Wang

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments NeurIPS 2024; project page: https://yhzhai.github.io/mcm/

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.10774 2024-10-15 cs.CV 79%

Cavia: Camera-controllable Multi-view Video Diffusion with View-Integrated Attention

Dejia Xu, Yifan Jiang, Chen Huang, Liangchen Song, Thorsten Gernoth, Liangliang Cao, Zhangyang Wang, Hao Tang

专题命中 视频扩散模型 :video diffusion(title);video generation(abstract);分类 cs.CV

Comments Project Page: https://ir1d.github.io/Cavia/

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.01594 2024-10-03 cs.CV 79%

MM-LDM: Multi-Modal Latent Diffusion Model for Sounding Video Generation

Mingzhen Sun, Weining Wang, Yanyuan Qiao, Jiahui Sun, Zihan Qin, Longteng Guo, Xinxin Zhu, Jing Liu

专题命中 视频扩散模型 :video generation(title,abstract);分类 cs.CV

Comments Accepted by ACM MM 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.11398 2024-09-10 cs.CV 79%

Animate3D: Animating Any 3D Model with Multi-view Video Diffusion

Yanqin Jiang, Chaohui Yu, Chenjie Cao, Fan Wang, Weiming Hu, Jin Gao

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments Project Page: https://animate3d.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.02048 2024-09-04 cs.CV 79%

ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis

Wangbo Yu, Jinbo Xing, Li Yuan, Wenbo Hu, Xiaoyu Li, Zhipeng Huang, Xiangjun Gao, Tien-Tsin Wong, Ying Shan, Yonghong Tian

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments Project page: https://drexubery.github.io/ViewCrafter/

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.01595 2024-09-04 cs.CV 79%

DiVE: DiT-based Video Generation with Enhanced Control

Junpeng Jiang, Gangyi Hong, Lijun Zhou, Enhui Ma, Hengtong Hu, Xia Zhou, Jie Xiang, Fan Liu, Kaicheng Yu, Haiyang Sun, Kun Zhan, Peng Jia, Miao Zhang

专题命中 视频扩散模型 :video generation(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.05479 2024-08-13 cs.CV 79%

ReToMe-VA: Recursive Token Merging for Video Diffusion-based Unrestricted Adversarial Attack

Ziyi Gao, Kai Chen, Zhipeng Wei, Tingshu Mou, Jingjing Chen, Zhiyu Tan, Hao Li, Yu-Gang Jiang

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.14134 2024-08-12 cs.LG cs.CV cs.RO 79%

Diffusion Reward: Learning Rewards via Conditional Video Diffusion

Tao Huang, Guangqi Jiang, Yanjie Ze, Huazhe Xu

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments Accepted to ECCV 2024. Project page and code: https://diffusion-reward.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.17485 2024-08-09 cs.CV 79%

EMO: Emote Portrait Alive -- Generating Expressive Portrait Videos with Audio2Video Diffusion Model under Weak Conditions

Linrui Tian, Qi Wang, Bang Zhang, Liefeng Bo

专题命中 视频扩散模型 :video diffusion(title);video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.12034 2024-07-22 cs.CV cs.GR cs.LG 79%

VFusion3D: Learning Scalable 3D Generative Models from Video Diffusion Models

Junlin Han, Filippos Kokkinos, Philip Torr

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments ECCV 2024. Project page: https://junlinhan.github.io/projects/vfusion3d.html

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.11585 2024-07-18 cs.CV cs.AI 79%

QVD: Post-training Quantization for Video Diffusion Models

Shilong Tian, Hong Chen, Chengtao Lv, Yu Liu, Jinyang Guo, Xianglong Liu, Shengxi Li, Hao Yang, Tao Xie

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments accepted by ACMMM2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.08737 2024-07-12 cs.CV cs.AI cs.LG cs.RO 79%

Video Diffusion Alignment via Reward Gradients

Mihir Prabhudesai, Russell Mendonca, Zheyang Qin, Katerina Fragkiadaki, Deepak Pathak

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments Project Webpage: https://vader-vid.github.io; Code available at: https://github.com/mihirp1998/VADER

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.08701 2024-07-12 cs.CV 79%

Live2Diff: Live Stream Translation via Uni-directional Attention in Video Diffusion Models

Zhening Xing, Gereon Fox, Yanhong Zeng, Xingang Pan, Mohamed Elgharib, Christian Theobalt, Kai Chen

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

Comments https://live2diff.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.06071 2024-06-21 cs.CV cs.LG physics.ao-ph stat.ML 79%

Precipitation Downscaling with Spatiotemporal Video Diffusion

Prakhar Srivastava, Ruihan Yang, Gavin Kerrigan, Gideon Dresdner, Jeremy McGibbon, Christopher Bretherton, Stephan Mandt

专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏