arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

视频大模型

视频理解、视频生成、视频语言模型和时序视觉推理。

共收录 2127 信号源:cs.CV, eess.IV, cs.MM

1. 视频生成 2127 篇

2502.11079 2025-04-11 cs.CV cs.AI 83%

Phantom: Subject-consistent video generation via cross-modal alignment

Lijie Liu, Tianxiang Ma, Bingchuan Li, Zhuowei Chen, Jiawei Liu, Gen Li, Siyu Zhou, Qian He, Xinglong Wu

专题命中 视频生成 :video generation(title,abstract);text-to-video(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.05014 2025-04-08 cs.CV 83%

MagicTime: Time-lapse Video Generation Models as Metamorphic Simulators

Shenghai Yuan, Jinfa Huang, Yujun Shi, Yongqi Xu, Ruijie Zhu, Bin Lin, Xinhua Cheng, Li Yuan, Jiebo Luo

专题命中 视频生成 :video generation(title,abstract);text-to-video(abstract);分类 cs.CV

Comments TPAMI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23368 2025-04-07 cs.CV cs.AI 83%

VLIPP: Towards Physically Plausible Video Generation with Vision and Language Informed Physical Prior

Xindi Yang, Baolu Li, Yiming Zhang, Zhenfei Yin, Lei Bai, Liqian Ma, Zhiyong Wang, Jianfei Cai, Tien-Tsin Wong, Huchuan Lu, Xu Jia

专题命中 视频生成 :video generation(title,abstract);video diffusion(abstract);分类 cs.CV

Comments 18 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.02312 2025-04-04 cs.CV cs.AI 83%

OmniCam: Unified Multimodal Video Generation via Camera Control

Xiaoda Yang, Jiayang Xu, Kaixuan Luan, Xinyu Zhan, Hongshun Qiu, Shijun Shi, Hao Li, Shuai Yang, Li Zhang, Checheng Yu, Cewu Lu, Lixin Yang

专题命中 视频生成 :video generation(title,abstract);video diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23715 2025-04-01 cs.CV 83%

HOIGen-1M: A Large-scale Dataset for Human-Object Interaction Video Generation

Kun Liu, Qi Liu, Xinchen Liu, Jie Li, Yongdong Zhang, Jiebo Luo, Xiaodong He, Wu Liu

专题命中 视频生成 :video generation(title,abstract);text-to-video(abstract);分类 cs.CV

Comments CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.12223 2025-03-31 cs.CV cs.AI 83%

Can video generation replace cinematographers? Research on the cinematic language of generated video

Xiaozhe Li, Kai WU, Siyi Yang, YiZhan Qu, Guohua. Zhang, Zhiyu Chen, Jiayao Li, Jiangchuan Mu, Xiaobin Hu, Wen Fang, Mingliang Xiong, Hao Deng, Qingwen Liu, Gang Li, Bin He

专题命中 视频生成 :video generation(title,abstract);text-to-video(abstract);分类 cs.CV

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.13726 2025-03-27 cs.CV cs.AI 83%

DAWN: Dynamic Frame Avatar with Non-autoregressive Diffusion Framework for Talking Head Video Generation

Hanbo Cheng, Limin Lin, Chenyu Liu, Pengcheng Xia, Pengfei Hu, Jiefeng Ma, Jun Du, Jia Pan

专题命中 视频生成 :video generation(title,abstract);long video(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18386 2025-03-25 cs.CV cs.AI 83%

Resource-Efficient Motion Control for Video Generation via Dynamic Mask Guidance

Sicong Feng, Jielong Yang, Li Peng

专题命中 视频生成 :video generation(title,abstract);text-to-video(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.17592 2025-03-20 cs.CV 83%

VideoDirector: Precise Video Editing via Text-to-Video Models

Yukun Wang, Longguang Wang, Zhiyuan Ma, Qibin Hu, Kai Xu, Yulan Guo

专题命中 视频生成 :text-to-video(title,abstract);video diffusion(abstract);分类 cs.CV

Comments 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.14070 2025-03-19 cs.CV cs.AI 83%

Fast Autoregressive Video Generation with Diagonal Decoding

Yang Ye, Junliang Guo, Haoyu Wu, Tianyu He, Tim Pearce, Tabish Rashid, Katja Hofmann, Jiang Bian

专题命中 视频生成 :video generation(title,abstract);long video(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10589 2025-03-14 cs.CV 83%

Long Context Tuning for Video Generation

Yuwei Guo, Ceyuan Yang, Ziyan Yang, Zhibei Ma, Zhijie Lin, Zhenheng Yang, Dahua Lin, Lu Jiang

专题命中 视频生成 :video generation(title,abstract);video diffusion(abstract);分类 cs.CV

Comments Project Page: https://guoyww.github.io/projects/long-context-video/

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.14295 2025-03-14 cs.CV 83%

StereoCrafter-Zero: Zero-Shot Stereo Video Generation with Noisy Restart

Jian Shi, Qian Wang, Zhenyu Li, Ramzi Idoughi, Peter Wonka

专题命中 视频生成 :video generation(title,abstract);video diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.05591 2025-03-05 cs.CV 83%

TweedieMix: Improving Multi-Concept Fusion for Diffusion-based Image/Video Generation

Gihyun Kwon, Jong Chul Ye

专题命中 视频生成 :video generation(title,abstract);video diffusion(abstract);分类 cs.CV

Comments Github Page: https://github.com/KwonGihyun/TweedieMix

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.14195 2025-02-26 cs.CV 83%

VideoShield: Regulating Diffusion-based Video Generation Models via Watermarking

Runyi Hu, Jie Zhang, Yiming Li, Jiwei Li, Qing Guo, Han Qiu, Tianwei Zhang

专题命中 视频生成 :video generation(title,abstract);text-to-video(abstract);分类 cs.CV

Comments International Conference on Learning Representations (ICLR) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.04989 2025-02-26 cs.CV cs.LG 83%

SG-I2V: Self-Guided Trajectory Control in Image-to-Video Generation

Koichi Namekata, Sherwin Bahmani, Ziyi Wu, Yash Kant, Igor Gilitschenski, David B. Lindell

专题命中 视频生成 :video generation(title,abstract);video diffusion(abstract);分类 cs.CV

Comments ICLR 2025. Project page: https://kmcode1.github.io/Projects/SG-I2V/

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.10126 2025-02-26 cs.CV 83%

Training-free Camera Control for Video Generation

Chen Hou, Zhibo Chen

专题命中 视频生成 :video generation(title,abstract);video diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15079 2025-02-24 cs.CV cs.AI cs.CL 83%

Can Hallucination Correction Improve Video-Language Alignment?

Lingjun Zhao, Mingyang Xie, Paola Cascante-Bonilla, Hal Daumé, Kwonjoon Lee

专题命中 视频生成 :video-language(title,abstract);text-to-video(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04299 2025-02-07 cs.CV 83%

MotionCanvas: Cinematic Shot Design with Controllable Image-to-Video Generation

Jinbo Xing, Long Mai, Cusuh Ham, Jiahui Huang, Aniruddha Mahapatra, Chi-Wing Fu, Tien-Tsin Wong, Feng Liu

专题命中 视频生成 :video generation(title,abstract);video diffusion(abstract);分类 cs.CV

Comments It is best viewed in Acrobat. Project page: https://motion-canvas25.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01690 2025-02-05 cs.CV 83%

HuViDPO:Enhancing Video Generation through Direct Preference Optimization for Human-Centric Alignment

Lifan Jiang, Boxi Wu, Jiahui Zhang, Xiaotong Guan, Shuang Chen

专题命中 视频生成 :video generation(title,abstract);text-to-video(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.09982 2025-02-04 cs.CV cs.AI cs.CL cs.LG 83%

RichSpace: Enriching Text-to-Video Prompt Space via Text Embedding Interpolation

Yuefan Cao, Chengyue Gong, Xiaoyu Li, Yingyu Liang, Zhizhou Sha, Zhenmei Shi, Zhao Song

专题命中 视频生成 :text-to-video(title,abstract);video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.16612 2025-01-29 cs.CV 83%

CascadeV: An Implementation of Wurstchen Architecture for Video Generation

Wenfeng Lin, Jiangchuan Wei, Boyuan Liu, Yichen Zhang, Shiyue Yan, Mingyu Guo

专题命中 视频生成 :video generation(title,abstract);text-to-video(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.07563 2025-01-14 cs.CV 83%

Training-Free Motion-Guided Video Generation with Enhanced Temporal Consistency Using Motion Consistency Loss

Xinyu Zhang, Zicheng Duan, Dong Gong, Lingqiao Liu

专题命中 视频生成 :video generation(title,abstract);video diffusion(abstract);分类 cs.CV

Comments Project page: https://zhangxinyu-xyz.github.io/SimulateMotion.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.13239 2024-12-30 cs.CV 83%

CustomCrafter: Customized Video Generation with Preserving Motion and Concept Composition Abilities

Tao Wu, Yong Zhang, Xintao Wang, Xianpan Zhou, Guangcong Zheng, Zhongang Qi, Ying Shan, Xi Li

专题命中 视频生成 :video generation(title,abstract);video diffusion(abstract);分类 cs.CV

Comments Accepted by AAAI 2025. Project page: https://customcrafter.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.15646 2024-12-24 cs.CV 83%

CustomTTT: Motion and Appearance Customized Video Generation via Test-Time Training

Xiuli Bi, Jian Lu, Bo Liu, Xiaodong Cun, Yong Zhang, Weisheng Li, Bin Xiao

专题命中 视频生成 :video generation(title);video diffusion(abstract);text-to-video(abstract);分类 cs.CV

Comments Accepted in AAAI 2025. Project Page: https://customttt.github.io/ Code: https://github.com/RongPiKing/CustomTTT

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.09623 2024-12-13 cs.CV 83%

OmniDrag: Enabling Motion Control for Omnidirectional Image-to-Video Generation

Weiqi Li, Shijie Zhao, Chong Mou, Xuhan Sheng, Zhenyu Zhang, Qian Wang, Junlin Li, Li Zhang, Jian Zhang

专题命中 视频生成 :video generation(title,abstract);video diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.12347 2024-12-12 cs.CV cs.GR 83%

AniClipart: Clipart Animation with Text-to-Video Priors

Ronghuan Wu, Wanchao Su, Kede Ma, Jing Liao

专题命中 视频生成 :text-to-video(title,abstract);video generation(abstract);分类 cs.CV

Comments IJCV 2024, Project Page: https://aniclipart.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.04966 2024-12-11 cs.CV 83%

NewMove: Customizing text-to-video models with novel motions

Joanna Materzynska, Josef Sivic, Eli Shechtman, Antonio Torralba, Richard Zhang, Bryan Russell

专题命中 视频生成 :text-to-video(title,abstract);video generation(abstract);分类 cs.CV

Comments Project page: this website https://joaanna.github.io/customizing_motion/

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.05630 2024-12-10 cs.CV 83%

Ctrl-V: Higher Fidelity Video Generation with Bounding-Box Controlled Object Motion

Ge Ya Luo, Zhi Hao Luo, Anthony Gosselin, Alexia Jolicoeur-Martineau, Christopher Pal

专题命中 视频生成 :video generation(title,abstract);video diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.00769 2024-12-09 cs.CV cs.AI 83%

GameGen-X: Interactive Open-world Game Video Generation

Haoxuan Che, Xuanhua He, Quande Liu, Cheng Jin, Hao Chen

专题命中 视频生成 :video generation(title,abstract);text-to-video(abstract);分类 cs.CV

Comments Homepage: https://gamegen-x.github.io/ Github: https://github.com/GameGen-X/GameGen-X

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.06269 2024-11-20 cs.CV 83%

FastVideoEdit: Leveraging Consistency Models for Efficient Text-to-Video Editing

Youyuan Zhang, Xuan Ju, James J. Clark

专题命中 视频生成 :text-to-video(title,abstract);video generation(abstract);分类 cs.CV

Comments Accepted to WACV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏