arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

视频大模型

视频理解、视频生成、视频语言模型和时序视觉推理。

共收录 6781 信号源:cs.CV, eess.IV, cs.MM

1. 视频扩散模型 1305 篇

2409.07179 2024-09-12 cs.CV 57%

Phy124: Fast Physics-Driven 4D Content Generation from a Single Image

Jiajing Lin, Zhenzhong Wang, Yongjie Hou, Yuzhou Tang, Min Jiang

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.03514 2024-09-06 cs.CV 57%

Blended Latent Diffusion under Attention Control for Real-World Video Editing

Deyin Liu, Lin Yuanbo Wu, Xianghua Xie

专题命中 视频扩散模型 :text-to-video(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.15111 2024-09-04 cs.CV cs.LG 57%

Matryoshka Diffusion Models

Jiatao Gu, Shuangfei Zhai, Yizhe Zhang, Josh Susskind, Navdeep Jaitly

专题命中 视频扩散模型 :text-to-video(abstract);分类 cs.CV

Comments Accepted by ICLR2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.17131 2024-09-02 cs.CV cs.AI 57%

VQ4DiT: Efficient Post-Training Vector Quantization for Diffusion Transformers

Juncan Deng, Shuaiting Li, Zeyu Wang, Hong Gu, Kedong Xu, Kejie Huang

专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV

Comments 11 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.16704 2024-08-30 cs.CV 57%

One-Shot Learning Meets Depth Diffusion in Multi-Object Videos

Anisha Jain

专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.15868 2024-08-29 cs.CV cs.AI 57%

GenDDS: Generating Diverse Driving Video Scenarios with Prompt-to-Video Generative Model

Yongjie Fu, Yunlong Li, Xuan Di

专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.14016 2024-08-27 cs.CV cs.AI 57%

Pixel-Aligned Multi-View Generation with Depth Guided Decoder

Zhenggang Tang, Peiye Zhuang, Chaoyang Wang, Aliaksandr Siarohin, Yash Kant, Alexander Schwing, Sergey Tulyakov, Hsin-Ying Lee

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.08342 2024-08-19 cs.GR cs.CV 57%

CT4D: Consistent Text-to-4D Generation with Animatable Meshes

Ce Chen, Shaoli Huang, Xuelin Chen, Guangyi Chen, Xiaoguang Han, Kun Zhang, Mingming Gong

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.02934 2024-08-09 cs.CV 57%

WoVoGen: World Volume-aware Diffusion for Controllable Multi-camera Driving Scene Generation

Jiachen Lu, Ze Huang, Zeyu Yang, Jiahui Zhang, Li Zhang

专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV

Comments ECCV 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.02024 2024-08-06 cs.CV 57%

Faster Diffusion Action Segmentation

Shuaibing Wang, Shunli Wang, Mingcheng Li, Dingkang Yang, Haopeng Kuang, Ziyun Qian, Lihua Zhang

专题命中 视频扩散模型 :long video(abstract);分类 cs.CV

Comments 25 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.13534 2024-08-05 cs.CV 57%

Motion-aware Latent Diffusion Models for Video Frame Interpolation

Zhilin Huang, Yijie Yu, Ling Yang, Chujun Qin, Bing Zheng, Xiawu Zheng, Zikun Zhou, Yaowei Wang, Wenming Yang

专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV

Comments 17 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.06062 2024-07-23 cs.CV cs.AI 57%

ProcessPainter: Learn Painting Process from Sequence Data

Yiren Song, Shijie Huang, Chen Yao, Xiaojun Ye, Hai Ci, Jiaming Liu, Yuxuan Zhang, Mike Zheng Shou

专题命中 视频扩散模型 :text-to-video(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.13903 2024-07-23 cs.CV 57%

Accelerating Image Generation with Sub-path Linear Approximation Model

Chen Xu, Tianhui Song, Weixin Feng, Xubin Li, Tiezheng Ge, Bo Zheng, Limin Wang

专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.10937 2024-07-16 cs.CV 57%

IDOL: Unified Dual-Modal Latent Diffusion for Human-Centric Joint Video-Depth Generation

Yuanhao Zhai, Kevin Lin, Linjie Li, Chung-Ching Lin, Jianfeng Wang, Zhengyuan Yang, David Doermann, Junsong Yuan, Zicheng Liu, Lijuan Wang

专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV

Comments ECCV 2024; project page: https://yhzhai.github.io/idol/

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.10476 2024-07-16 cs.CV cs.AI 57%

Kinetic Typography Diffusion Model

Seonmi Park, Inhwan Bae, Seunghyun Shin, Hae-Gon Jeon

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

Comments Accepted at ECCV 2024, Project page: https://seonmip.github.io/kinety

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.08231 2024-07-12 cs.CV 57%

E2VIDiff: Perceptual Events-to-Video Reconstruction using Diffusion Priors

Jinxiu Liang, Bohan Yu, Yixin Yang, Yiming Han, Boxin Shi

专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.15829 2024-06-25 cs.CV 57%

MVOC: a training-free multiple video object composition method with diffusion models

Wei Wang, Yaosen Chen, Yuegen Liu, Qi Yuan, Shubin Yang, Yanru Zhang

专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.08204 2024-06-13 cs.CV 57%

Diffusion-Promoted HDR Video Reconstruction

Yuanshen Guan, Ruikang Xu, Mingde Yao, Ruisheng Gao, Lizhi Wang, Zhiwei Xiong

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

Comments Arxiv Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.04662 2024-06-10 cs.CV 57%

Evaluating and Mitigating IP Infringement in Visual Generative AI

Zhenting Wang, Chen Chen, Vikash Sehwag, Minzhou Pan, Lingjuan Lyu

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.07133 2024-06-04 cs.CV cs.LG 57%

LatentMan: Generating Consistent Animated Characters using Image Diffusion Models

Abdelrahman Eldesokey, Peter Wonka

专题命中 视频扩散模型 :text-to-video(abstract);分类 cs.CV

Comments CVPRW 2024. Project page: https://abdo-eldesokey.github.io/latentman/

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.14329 2024-06-04 cs.CV 57%

X-Ray: A Sequential 3D Representation For Generation

Tao Hu, Wenhang Ge, Yuyang Zhao, Gim Hee Lee

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.20334 2024-05-31 cs.CV cs.GR 57%

VividDream: Generating 3D Scene with Ambient Dynamics

Yao-Chih Lee, Yi-Ting Chen, Andrew Wang, Ting-Hsuan Liao, Brandon Y. Feng, Jia-Bin Huang

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

Comments Project page: https://vivid-dream-4d.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.16947 2024-05-28 cs.CV 57%

Zero-Shot Video Semantic Segmentation based on Pre-Trained Diffusion Models

Qian Wang, Abdelrahman Eldesokey, Mohit Mendiratta, Fangneng Zhan, Adam Kortylewski, Christian Theobalt, Peter Wonka

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

Comments Project webpage: https://qianwangx.github.io/VidSeg_diffusion/

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.16854 2024-05-08 cs.CV 57%

A Unified Approach for Text- and Image-guided 4D Scene Generation

Yufeng Zheng, Xueting Li, Koki Nagano, Sifei Liu, Karsten Kreis, Otmar Hilliges, Shalini De Mello

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

Comments Project page: https://research.nvidia.com/labs/nxp/dream-in-4d/

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.08068 2024-05-06 cs.CV cs.AI cs.LG 57%

DORSal: Diffusion for Object-centric Representations of Scenes et al

Allan Jabri, Sjoerd van Steenkiste, Emiel Hoogeboom, Mehdi S. M. Sajjadi, Thomas Kipf

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

Comments Accepted to ICLR 2024. Project page: https://www.sjoerdvansteenkiste.com/dorsal

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.19277 2024-05-01 cs.CV 57%

Bridge to Non-Barrier Communication: Gloss-Prompted Fine-grained Cued Speech Gesture Generation with Diffusion Model

Wentao Lei, Li Liu, Jun Wang

专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV

Journal ref IJCAI 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.20092 2024-04-08 cs.LG cs.CV 57%

The Missing U for Efficient Diffusion Models

Sergio Calvo-Ordonez, Chun-Wun Cheng, Jiahao Huang, Lipei Zhang, Guang Yang, Carola-Bibiane Schonlieb, Angelica I Aviles-Rivero

专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV

Comments 23 pages, 14 figures, Accepted at Transactions of Machine Learning Research (04/2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.01709 2024-04-03 cs.CV cs.AI 57%

Upsample Guidance: Scale Up Diffusion Models without Training

Juno Hwang, Yong-Hyun Park, Junghyo Jo

专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV

Comments 15 pages, 15 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.10786 2024-04-02 cs.CV 57%

Sat2Scene: 3D Urban Scene Generation from Satellite Images with Diffusion

Zuoyue Li, Zhenqiang Li, Zhaopeng Cui, Marc Pollefeys, Martin R. Oswald

专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV

Journal ref CVPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.16530 2024-03-26 cs.CV cs.AI 57%

An Intermediate Fusion ViT Enables Efficient Text-Image Alignment in Diffusion Models

Zizhao Hu, Shaochong Jia, Mohammad Rostami

专题命中 视频扩散模型 :text-to-video(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏