arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

视频大模型

视频理解、视频生成、视频语言模型和时序视觉推理。

共收录 1299 信号源:cs.CV, eess.IV, cs.MM

1. 视频扩散模型 1299 篇

2502.12752 2025-02-19 cs.CV 57%

High-Fidelity Novel View Synthesis via Splatting-Guided Diffusion

Xiang Zhang, Yang Zhang, Lukas Mehl, Markus Gross, Christopher Schroers

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11697 2025-02-18 cs.CV 57%

MVTokenFlow: High-quality 4D Content Generation using Multiview Token Flow

Hanzhuo Huang, Yuan Liu, Ge Zheng, Jiepeng Wang, Zhiyang Dou, Sibei Yang

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

Comments ICLR 2025. Project page: https://soolab.github.io/MVTokenFlow

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.19331 2025-02-03 cs.CV 57%

Consistent Video Colorization via Palette Guidance

Han Wang, Yuang Zhang, Yuhong Zhang, Lingxiao Lu, Li Song

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.18982 2025-02-03 cs.CV 57%

OmniPhysGS: 3D Constitutive Gaussians for General Physics-Based Dynamics Generation

Yuchen Lin, Chenguo Lin, Jianjin Xu, Yadong Mu

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

Comments Accepted to ICLR 2025; Project page: https://wgsxm.github.io/projects/omniphysgs/

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.14173 2025-01-31 cs.CV 57%

AniDoc: Animation Creation Made Easier

Yihao Meng, Hao Ouyang, Hanlin Wang, Qiuyu Wang, Wen Wang, Ka Leong Cheng, Zhiheng Liu, Yujun Shen, Huamin Qu

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

Comments Project page and code: https://yihao-meng.github.io/AniDoc_demo

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.15368 2025-01-24 cs.CV 57%

Flow-Guided Diffusion for Video Inpainting

Bohai Gu, Yongsheng Yu, Heng Fan, Libo Zhang

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

Comments This paper has been withdrawn as a new iteration of the work has been developed, which includes significant improvements and refinements based on this submission. The withdrawal is made to ensure academic integrity and compliance with publication standards. If you are interested, please refer to the updated work at arXiv:2412.00857

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.03374 2025-01-08 cs.CV cs.AI cs.LG 57%

License Plate Images Generation with Diffusion Models

Mariia Shpir, Nadiya Shvai, Amir Nakib

专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV

Journal ref Frontiers in Artificial Intelligence and Applications, Vol. 392, 2024, pp. 4594-4601

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.13144 2025-01-03 cs.LG cs.CV 57%

Neural Network Diffusion

Kai Wang, Dongwen Tang, Boya Zeng, Yida Yin, Zhaopan Xu, Yukun Zhou, Zelin Zang, Trevor Darrell, Zhuang Liu, Yang You

专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV

Comments We introduce a novel approach for parameter generation, named neural network parameter diffusion (\textbf{p-diff}), which employs a standard latent diffusion model to synthesize a new set of parameters

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.14768 2024-12-31 cs.CV cs.AI 57%

AdaDiff: Adaptive Step Selection for Fast Diffusion Models

Hui Zhang, Zuxuan Wu, Zhen Xing, Jie Shao, Yu-Gang Jiang

专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV

Comments Accepted by AAAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.16700 2024-12-24 cs.CV 57%

TCAQ-DM: Timestep-Channel Adaptive Quantization for Diffusion Models

Haocheng Huang, Jiaxin Chen, Jinyang Guo, Ruiyi Zhan, Yunhong Wang

专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.13479 2024-12-19 cs.CV 57%

Real-time One-Step Diffusion-based Expressive Portrait Videos Generation

Hanzhong Guo, Hongwei Yi, Daquan Zhou, Alexander William Bergman, Michael Lingelbach, Yizhou Yu

专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.10178 2024-12-19 cs.CV cs.AI 57%

SwiftTry: Fast and Consistent Video Virtual Try-On with Diffusion Models

Hung Nguyen, Quang Qui-Vinh Nguyen, Khoi Nguyen, Rang Nguyen

专题命中 视频扩散模型 :long video(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.09551 2024-12-13 cs.CV 57%

Video Creation by Demonstration

Yihong Sun, Hao Zhou, Liangzhe Yuan, Jennifer J. Sun, Yandong Li, Xuhui Jia, Hartwig Adam, Bharath Hariharan, Long Zhao, Ting Liu

专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV

Comments Project page at https://delta-diffusion.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.18293 2024-12-11 cs.CV 57%

HiFiVFS: High Fidelity Video Face Swapping

Xu Chen, Keke He, Junwei Zhu, Yanhao Ge, Wei Li, Chengjie Wang

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.11814 2024-12-10 cs.CV 57%

Contrastive Sequential-Diffusion Learning: Non-linear and Multi-Scene Instructional Video Synthesis

Vasco Ramos, Yonatan Bitton, Michal Yarom, Idan Szpektor, Joao Magalhaes

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.03079 2024-12-06 cs.CV 57%

Align3R: Aligned Monocular Depth Estimation for Dynamic Videos

Jiahao Lu, Tianyu Huang, Peng Li, Zhiyang Dou, Cheng Lin, Zhiming Cui, Zhen Dong, Sai-Kit Yeung, Wenping Wang, Yuan Liu

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

Comments Project Page: https://igl-hkust.github.io/Align3R.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.01106 2024-12-03 cs.CV cs.GR 57%

One Shot, One Talk: Whole-body Talking Avatar from a Single Image

Jun Xiang, Yudong Guo, Leipeng Hu, Boyang Guo, Yancheng Yuan, Juyong Zhang

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

Comments Project Page: https://ustc3dv.github.io/OneShotOneTalk/

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.00397 2024-12-03 cs.CV 57%

DreamDance: Animating Human Images by Enriching 3D Geometry Cues from 2D Poses

Yatian Pang, Bin Zhu, Bin Lin, Mingzhe Zheng, Francis E. H. Tay, Ser-Nam Lim, Harry Yang, Li Yuan

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.17697 2024-11-28 cs.CV cs.AI 57%

StableAnimator: High-Quality Identity-Preserving Human Image Animation

Shuyuan Tu, Zhen Xing, Xintong Han, Zhi-Qi Cheng, Qi Dai, Chong Luo, Zuxuan Wu

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.13975 2024-11-22 cs.CV 57%

Transforming Static Images Using Generative Models for Video Salient Object Detection

Suhwan Cho, Minhyeok Lee, Jungho Lee, Sangyoun Lee

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.17343 2024-11-21 cs.CV cs.AI 57%

Q-DiT: Accurate Post-Training Quantization for Diffusion Transformers

Lei Chen, Yuan Meng, Chen Tang, Xinzhu Ma, Jingyan Jiang, Xin Wang, Zhi Wang, Wenwu Zhu

专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.10582 2024-11-19 cs.CV 57%

Motion Diffusion-Guided 3D Global HMR from a Dynamic Camera

Jaewoo Heo, Kuan-Chieh Wang, Karen Liu, Serena Yeung-Levy

专题命中 视频扩散模型 :long video(abstract);分类 cs.CV

Comments 15 pages, 2 figures, submitted to TMLR

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.22901 2024-10-31 cs.CV 57%

HelloMeme: Integrating Spatial Knitting Attentions to Embed High-Level and Fidelity-Rich Conditions in Diffusion Models

Shengkai Zhang, Nianhong Jiao, Tian Li, Chaojie Yang, Chenhui Xue, Boya Niu, Jun Gao

专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV

Comments 11 pages, 7 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.08552 2024-10-21 cs.CV 57%

DiTFastAttn: Attention Compression for Diffusion Transformer Models

Zhihang Yuan, Hanling Zhang, Pu Lu, Xuefei Ning, Linfeng Zhang, Tianchen Zhao, Shengen Yan, Guohao Dai, Yu Wang

专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.11795 2024-10-17 cs.CV 57%

Efficient Diffusion Models: A Comprehensive Survey from Principles to Practices

Zhiyuan Ma, Yuzhu Zhang, Guoli Jia, Liangliang Zhao, Yichao Ma, Mingjie Ma, Gaofeng Liu, Kaiyan Zhang, Jianjun Li, Bowen Zhou

专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.09608 2024-10-16 cs.CV 57%

Faster Diffusion: Rethinking the Role of the Encoder for Diffusion Model Inference

Senmao Li, Taihang Hu, Joost van de Weijer, Fahad Shahbaz Khan, Tao Liu, Linxuan Li, Shiqi Yang, Yaxing Wang, Ming-Ming Cheng, Jian Yang

专题命中 视频扩散模型 :text-to-video(abstract);分类 cs.CV

Comments NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.07718 2024-10-15 cs.CV 57%

Hallo2: Long-Duration and High-Resolution Audio-Driven Portrait Image Animation

Jiahao Cui, Hui Li, Yao Yao, Hao Zhu, Hanlin Shang, Kaihui Cheng, Hang Zhou, Siyu Zhu, Jingdong Wang

专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.09873 2024-10-15 cs.CV 57%

Training-Free Adaptive Diffusion with Bounded Difference Approximation Strategy

Hancheng Ye, Jiakang Yuan, Renqiu Xia, Xiangchao Yan, Tao Chen, Junchi Yan, Botian Shi, Bo Zhang

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

Comments Accepted by NeurIPS 2024, Homepage: https://jiakangyuan.github.io/AdaptiveDiffusion-project-page/ The code is available at https://github.com/UniModal4Reasoning/AdaptiveDiffusion

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.04171 2024-10-10 cs.CV cs.AI 57%

IV-Mixed Sampler: Leveraging Image Diffusion Models for Enhanced Video Synthesis

Shitong Shao, Zikai Zhou, Lichen Bai, Haoyi Xiong, Zeke Xie

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.00251 2024-10-10 cs.CV cs.LG 57%

Semantically Consistent Video Inpainting with Conditional Diffusion Models

Dylan Green, William Harvey, Saeid Naderiparizi, Matthew Niedoba, Yunpeng Liu, Xiaoxuan Liang, Jonathan Lavington, Ke Zhang, Vasileios Lioutas, Setareh Dabiri, Adam Scibior, Berend Zwartsenberg, Frank Wood

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏