arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

视频大模型

视频理解、视频生成、视频语言模型和时序视觉推理。

共收录 6771 信号源:cs.CV, eess.IV, cs.MM

1. 视频生成 2143 篇

2503.20822 2025-03-28 eess.IV cs.AI cs.GR 57%

Synthetic Video Enhances Physical Fidelity in Video Synthesis

Qi Zhao, Xingyu Ni, Ziyu Wang, Feng Cheng, Ziyan Yang, Lu Jiang, Bohan Wang

专题命中 视频生成 :video generation(abstract);分类 eess.IV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.01409 2025-03-28 cs.CV cs.AI 57%

JOG3R: Towards 3D-Consistent Video Generators

Chun-Hao Paul Huang, Niloy Mitra, Hyeonho Jeong, Jae Shin Yoon, Duygu Ceylan

专题命中 视频生成 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.20523 2025-03-27 cs.CV cs.AI cs.RO 57%

GAIA-2: A Controllable Multi-View Generative World Model for Autonomous Driving

Lloyd Russell, Anthony Hu, Lorenzo Bertoni, George Fedoseev, Jamie Shotton, Elahe Arani, Gianluca Corrado

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.20118 2025-03-27 cs.GR cs.AI cs.CV 57%

Zero-Shot Human-Object Interaction Synthesis with Multimodal Priors

Yuke Lou, Yiming Wang, Zhen Wu, Rui Zhao, Wenjia Wang, Mingyi Shi, Taku Komura

专题命中 视频生成 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.14526 2025-03-27 cs.CV cs.AI cs.CY cs.LG 57%

Fantastic Copyrighted Beasts and How (Not) to Generate Them

Luxi He, Yangsibo Huang, Weijia Shi, Tinghao Xie, Haotian Liu, Yue Wang, Luke Zettlemoyer, Chiyuan Zhang, Danqi Chen, Peter Henderson

专题命中 视频生成 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01441 2025-03-26 cs.CV cs.LG 57%

Improved Training Technique for Latent Consistency Models

Quan Dao, Khanh Doan, Di Liu, Trung Le, Dimitris Metaxas

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments Accepted at ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18429 2025-03-25 cs.CV 57%

Teller: Real-Time Streaming Audio-Driven Portrait Animation with Autoregressive Motion Generation

Dingcheng Zhen, Shunshun Yin, Shiyang Qin, Hou Yi, Ziwei Zhang, Siyuan Liu, Gan Qi, Ming Tao

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments Accept in CVPR 2025 Conference Submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17029 2025-03-24 cs.CV 57%

AnimatePainter: A Self-Supervised Rendering Framework for Reconstructing Painting Process

Junjie Hu, Shuyong Gao, Qianyu Guo, Yan Wang, Qishan Wang, Yuang Feng, Wenqiang Zhang

专题命中 视频生成 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15855 2025-03-21 cs.CV cs.AI 57%

VideoRFSplat: Direct Scene-Level Text-to-3D Gaussian Splatting Generation with Flexible Pose and Multi-View Joint Modeling

Hyojun Go, Byeongjun Park, Hyelin Nam, Byung-Hoon Kim, Hyungjin Chung, Changick Kim

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments Project page: https://gohyojun15.github.io/VideoRFSplat/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15417 2025-03-20 cs.CV cs.AI 57%

Temporal Regularization Makes Your Video Generator Stronger

Harold Haodong Chen, Haojian Huang, Xianfeng Wu, Yexin Liu, Yajing Bai, Wen-Jie Shu, Harry Yang, Ser-Nam Lim

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments Project: https://haroldchen19.github.io/FluxFlow/

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.08976 2025-03-19 cs.CV cs.LG 57%

Identity-Preserving Pose-Guided Character Animation via Facial Landmarks Transformation

Lianrui Mu, Xingze Zhou, Wenjie Zheng, Jiangnan Ye, Haoji Hu

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments 6 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.02114 2025-03-19 cs.CV cs.AI 57%

Beyond Generation: Unlocking Universal Editing via Self-Supervised Fine-Tuning

Harold Haodong Chen, Harry Yang, Ser-Nam Lim

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments Project: https://haroldchen19.github.io/UES-Page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12535 2025-03-18 cs.CV 57%

SPC-GS: Gaussian Splatting with Semantic-Prompt Consistency for Indoor Open-World Free-view Synthesis from Sparse Inputs

Guibiao Liao, Qing Li, Zhenyu Bao, Guoping Qiu, Kanglin Liu

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments Accepted by CVPR2025. The project page is available at https://gbliao.github.io/SPC-GS.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10076 2025-03-18 cs.CV 57%

VMBench: A Benchmark for Perception-Aligned Video Motion Generation

Xinran Ling, Chen Zhu, Meiqi Wu, Hangyu Li, Xiaokun Feng, Cundian Yang, Aiming Hao, Jiashu Zhu, Jiahong Wu, Xiangxiang Chu

专题命中 视频生成 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.18775 2025-03-18 cs.CV cs.AI cs.CR 57%

Robust Watermarking Using Generative Priors Against Image Editing: From Benchmarking to Advances

Shilin Lu, Zihan Zhou, Jiayou Lu, Yuanzhi Zhu, Adams Wai-Kin Kong

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments Accepted by ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.17532 2025-03-17 cs.CV 57%

ClassDiffusion: More Aligned Personalization Tuning with Explicit Class Guidance

Jiannan Huang, Jun Hao Liew, Hanshu Yan, Yuyang Yin, Yao Zhao, Humphrey Shi, Yunchao Wei

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments Accepted to ICLR2025, Code is available at https://github.com/Rbrq03/ClassDiffusion

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09871 2025-03-14 cs.CV 57%

LuciBot: Automated Robot Policy Learning from Generated Videos

Xiaowen Qiu, Yian Wang, Jiting Cai, Zhehuan Chen, Chunru Lin, Tsun-Hsuan Wang, Chuang Gan

专题命中 视频生成 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.06734 2025-03-13 cs.CV 57%

Señorita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists

Bojia Zi, Penghui Ruan, Marco Chen, Xianbiao Qi, Shaozhe Hao, Shihao Zhao, Youze Huang, Bin Liang, Rong Xiao, Kam-Fai Wong

专题命中 视频生成 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.08037 2025-03-12 cs.GR cs.AI cs.CV 57%

ObjectMover: Generative Object Movement with Video Prior

Xin Yu, Tianyu Wang, Soo Ye Kim, Paul Guerrero, Xi Chen, Qing Liu, Zhe Lin, Xiaojuan Qi

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments CVPR 2025, Project Page: https://xinyu-andy.github.io/ObjMover

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07598 2025-03-12 cs.CV 57%

VACE: All-in-One Video Creation and Editing

Zeyinzi Jiang, Zhen Han, Chaojie Mao, Jingfeng Zhang, Yulin Pan, Yu Liu

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments Project page: https://ali-vilab.github.io/VACE-Page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.01156 2025-03-12 cs.CV cs.AI cs.LG 57%

TexAVi: Generating Stereoscopic VR Video Clips from Text Descriptions

Vriksha Srihari, R. Bhavya, Shruti Jayaraman, V. Mary Anita Rajam

专题命中 视频生成 :text-to-video(abstract);分类 cs.CV

Comments Co-authors do not consent to publishing on Arxiv

Journal ref TexAVi: Generating Stereoscopic VR Video Clips from Text Descriptions, 2024 IEEE International Conference on Computer Vision and Machine Intelligence (CVMI), Prayagraj, India, 2024, pp. 1-6

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.03603 2025-03-12 cs.CV 57%

HunyuanVideo: A Systematic Framework For Large Video Generative Models

Weijie Kong, Qi Tian, Zijian Zhang, Rox Min, Zuozhuo Dai, Jin Zhou, Jiangfeng Xiong, Xin Li, Bo Wu, Jianwei Zhang, Kathrina Wu, Qin Lin, Junkun Yuan, Yanxin Long, Aladdin Wang, Andong Wang, Changlin Li, Duojun Huang, Fang Yang, Hao Tan, Hongmei Wang, Jacob Song, Jiawang Bai, Jianbing Wu, Jinbao Xue, Joey Wang, Kai Wang, Mengyang Liu, Pengyu Li, Shuai Li, Weiyan Wang, Wenqing Yu, Xinchi Deng, Yang Li, Yi Chen, Yutao Cui, Yuanbo Peng, Zhentao Yu, Zhiyu He, Zhiyong Xu, Zixiang Zhou, Zunnan Xu, Yangyu Tao, Qinglin Lu, Songtao Liu, Dax Zhou, Hongfa Wang, Yong Yang, Di Wang, Yuhong Liu, Jie Jiang, Caesar Zhong

专题命中 视频生成 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07602 2025-03-11 cs.CV 57%

DreamRelation: Relation-Centric Video Customization

Yujie Wei, Shiwei Zhang, Hangjie Yuan, Biao Gong, Longxiang Tang, Xiang Wang, Haonan Qiu, Hengjia Li, Shuai Tan, Yingya Zhang, Hongming Shan

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments Project Page: https://dreamrelation.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.06020 2025-03-11 cs.CV 57%

VidStyleODE: Disentangled Video Editing via StyleGAN and NeuralODEs

Moayed Haji Ali, Andrew Bond, Tolga Birdal, Duygu Ceylan, Levent Karacan, Erkut Erdem, Aykut Erdem

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments Project website: https://cyberiada.github.io/VidStyleODE

Journal ref 2023 IEEE/CVF International Conference on Computer Vision (ICCV)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07314 2025-03-11 cs.CV 57%

Automated Movie Generation via Multi-Agent CoT Planning

Weijia Wu, Zeyu Zhu, Mike Zheng Shou

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments The code and project website are available at: https://github.com/showlab/MovieAgent and https://weijiawu.github.io/MovieAgent

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.03558 2025-03-06 cs.CV 57%

High-Quality Virtual Single-Viewpoint Surgical Video: Geometric Autocalibration of Multiple Cameras in Surgical Lights

Yuna Kato, Mariko Isogawa, Shohei Mori, Hideo Saito, Hiroki Kajita, Yoshifumi Takatsume

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments Accepted at MICCAI2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.09781 2025-03-06 cs.CV 57%

VideoWorld: Exploring Knowledge Learning from Unlabeled Videos

Zhongwei Ren, Yunchao Wei, Xun Guo, Yao Zhao, Bingyi Kang, Jiashi Feng, Xiaojie Jin

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments Code and models are released at: https://maverickren.github.io/VideoWorld.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.07508 2025-02-28 cs.CV 57%

Enhance-A-Video: Better Generated Video for Free

Yang Luo, Xuanlei Zhao, Mengzhao Chen, Kaipeng Zhang, Wenqi Shao, Kai Wang, Zhangyang Wang, Yang You

专题命中 视频生成 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.17258 2025-02-25 cs.CV 57%

VideoGrain: Modulating Space-Time Attention for Multi-grained Video Editing

Xiangpeng Yang, Linchao Zhu, Hehe Fan, Yi Yang

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments ICLR 2025, code and demos are available at https://knightyxp.github.io/VideoGrain_project_page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.14424 2025-02-25 cs.CR cs.AI cs.CV 57%

Dormant: Defending against Pose-driven Human Image Animation

Jiachen Zhou, Mingsi Wang, Tianlin Li, Guozhu Meng, Kai Chen

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments Accepted by USENIX Security 2025

详情

展开后加载摘要…

URL PDF HTML 收藏