arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

视频大模型

视频理解、视频生成、视频语言模型和时序视觉推理。

共收录 2143 信号源:cs.CV, eess.IV, cs.MM

1. 视频生成 2143 篇

2502.17258 2025-02-25 cs.CV 57%

VideoGrain: Modulating Space-Time Attention for Multi-grained Video Editing

Xiangpeng Yang, Linchao Zhu, Hehe Fan, Yi Yang

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments ICLR 2025, code and demos are available at https://knightyxp.github.io/VideoGrain_project_page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.14424 2025-02-25 cs.CR cs.AI cs.CV 57%

Dormant: Defending against Pose-driven Human Image Animation

Jiachen Zhou, Mingsi Wang, Tianlin Li, Guozhu Meng, Kai Chen

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments Accepted by USENIX Security 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.14844 2025-02-21 cs.GR cs.CV cs.LG 57%

Dynamic Concepts Personalization from Single Videos

Rameen Abdal, Or Patashnik, Ivan Skorokhodov, Willi Menapace, Aliaksandr Siarohin, Sergey Tulyakov, Daniel Cohen-Or, Kfir Aberman

专题命中 视频生成 :text-to-video(abstract);分类 cs.CV

Comments Webpage: https://snap-research.github.io/dynamic_concepts/

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.15239 2025-02-13 cs.CV 57%

Generative Inbetweening: Adapting Image-to-Video Models for Keyframe Interpolation

Xiaojuan Wang, Boyang Zhou, Brian Curless, Ira Kemelmacher-Shlizerman, Aleksander Holynski, Steven M. Seitz

专题命中 视频生成 :video diffusion(abstract);分类 cs.CV

Comments Published at ICLR 2025; Project page: https://svd-keyframe-interpolation.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.18801 2025-02-03 cs.CV cs.AI 57%

Every Image Listens, Every Image Dances: Music-Driven Image Animation

Zhikang Dong, Weituo Hao, Ju-Chiang Wang, Peng Zhang, Pawel Polak

专题命中 视频生成 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.09755 2025-01-17 cs.CV cs.AI 57%

Learnings from Scaling Visual Tokenizers for Reconstruction and Generation

Philippe Hansen-Estruch, David Yan, Ching-Yao Chung, Orr Zohar, Jialiang Wang, Tingbo Hou, Tao Xu, Sriram Vishwanath, Peter Vajda, Xinlei Chen

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments 28 pages, 25 figures, 7 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.08370 2025-01-16 cs.GR cs.CV 57%

3D Gaussian Splatting with Normal Information for Mesh Extraction and Improved Rendering

Meenakshi Krishnan, Liam Fowl, Ramani Duraiswami

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments ICASSP 2025: Workshop on Generative Data Augmentation for Real-World Signal Processing Applications

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.01798 2025-01-06 cs.CV 57%

JoyGen: Audio-Driven 3D Depth-Aware Talking-Face Video Editing

Qili Wang, Dajiang Wu, Zihang Xu, Junshi Huang, Jun Lv

专题命中 视频生成 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.20901 2024-12-31 cs.CV cs.AI 57%

ILDiff: Generate Transparent Animated Stickers by Implicit Layout Distillation

Ting Zhang, Zhiqiang Yuan, Yeshuang Zhu, Jinchao Zhang

专题命中 视频生成 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.19761 2024-12-30 cs.CV 57%

Generative Video Propagation

Shaoteng Liu, Tianyu Wang, Jui-Hsien Wang, Qing Liu, Zhifei Zhang, Joon-Young Lee, Yijun Li, Bei Yu, Zhe Lin, Soo Ye Kim, Jiaya Jia

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments 11 pages, 18 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.16212 2024-12-24 cs.CV 57%

ManiVideo: Generating Hand-Object Manipulation Video with Dexterous and Generalizable Grasping

Youxin Pang, Ruizhi Shao, Jiajun Zhang, Hanzhang Tu, Yun Liu, Boyao Zhou, Hongwen Zhang, Yebin Liu

专题命中 视频生成 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.13061 2024-12-18 cs.CV cs.AI cs.LG 57%

VidTok: A Versatile and Open-Source Video Tokenizer

Anni Tang, Tianyu He, Junliang Guo, Xinle Cheng, Li Song, Jiang Bian

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments Code & Models: https://github.com/microsoft/VidTok

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.08410 2024-12-16 cs.CV 57%

Physical Informed Driving World Model

Zhuoran Yang, Xi Guo, Chenjing Ding, Chiyu Wang, Wei Wu

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments project homepage: https://metadrivescape.github.io/papers_project/DrivePhysica/page.html

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.07774 2024-12-13 cs.CV 57%

UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics

Xi Chen, Zhifei Zhang, He Zhang, Yuqian Zhou, Soo Ye Kim, Qing Liu, Yijun Li, Jianming Zhang, Nanxuan Zhao, Yilin Wang, Hui Ding, Zhe Lin, Hengshuang Zhao

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments webpage: https://xavierchen34.github.io/UniReal-Page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.07540 2024-12-12 cs.CV cs.LG 57%

Ctrl-X: Controlling Structure and Appearance for Text-To-Image Generation Without Guidance

Kuan Heng Lin, Sicheng Mo, Ben Klingher, Fangzhou Mu, Bolei Zhou

专题命中 视频生成 :text-to-video(abstract);分类 cs.CV

Comments 22 pages, 17 figures, see project page at https://genforce.github.io/ctrl-x

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.07744 2024-12-11 cs.CV 57%

StyleMaster: Stylize Your Video with Artistic Generation and Translation

Zixuan Ye, Huijuan Huang, Xintao Wang, Pengfei Wan, Di Zhang, Wenhan Luo

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments Project webpage available at https://zixuan-ye.github.io/stylemaster

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06878 2024-12-11 cs.CV cs.LG 57%

SafeWatch: An Efficient Safety-Policy Following Video Guardrail Model with Transparent Explanations

Zhaorun Chen, Francesco Pinto, Minzhou Pan, Bo Li

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments 43 pages, 20 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.03837 2024-12-06 cs.AI cs.CV 57%

Movie Gen: SWOT Analysis of Meta's Generative AI Foundation Model for Transforming Media Generation, Advertising, and Entertainment Industries

Abul Ehtesham, Saket Kumar, Aditi Singh, Tala Talaei Khoei

专题命中 视频生成 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.02684 2024-12-04 cs.CV cs.AI 57%

AniGS: Animatable Gaussian Avatar from a Single Image with Inconsistent Gaussian Reconstruction

Lingteng Qiu, Shenhao Zhu, Qi Zuo, Xiaodong Gu, Yuan Dong, Junfei Zhang, Chao Xu, Zhe Li, Weihao Yuan, Liefeng Bo, Guanying Chen, Zilong Dong

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments Project Page: https://lingtengqiu.github.io/2024/AniGS/

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.17189 2024-12-02 cs.CV 57%

PhysMotion: Physics-Grounded Dynamics From a Single Image

Xiyang Tan, Ying Jiang, Xuan Li, Zeshun Zong, Tianyi Xie, Yin Yang, Chenfanfu Jiang

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments Project Page: https://supertan0204.github.io/physmotion_website/

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.13571 2024-11-26 cs.CV 57%

DriveDreamer4D: World Models Are Effective Data Machines for 4D Driving Scene Representation

Guosheng Zhao, Chaojun Ni, Xiaofeng Wang, Zheng Zhu, Xueyang Zhang, Yida Wang, Guan Huang, Xinze Chen, Boyuan Wang, Youyi Zhang, Wenjun Mei, Xingang Wang

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments Project Page: https://drivedreamer4d.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.08666 2024-11-19 cs.CV cs.AI 57%

A Survey on Vision Autoregressive Model

Kai Jiang, Jiaxing Huang

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments This work will be integrated into another project

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.03047 2024-11-19 cs.CV 57%

MagicStick: Controllable Video Editing via Control Handle Transformations

Yue Ma, Xiaodong Cun, Sen Liang, Jinbo Xing, Yingqing He, Chenyang Qi, Siran Chen, Qifeng Chen

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments Accepted by WACV 2025, Project page: https://magic-stick-edit.github.io/ Github repository: https://github.com/mayuelala/MagicStick

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.07754 2024-11-12 cs.CV 57%

HOI-Swap: Swapping Objects in Videos with Hand-Object Interaction Awareness

Zihui Xue, Mi Luo, Changan Chen, Kristen Grauman

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments Accepted by NeurIPS 2024, Project website: https://vision.cs.utexas.edu/projects/HOI-Swap/

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.18978 2024-11-05 cs.CV 57%

Framer: Interactive Frame Interpolation

Wen Wang, Qiuyu Wang, Kecheng Zheng, Hao Ouyang, Zhekai Chen, Biao Gong, Hao Chen, Yujun Shen, Chunhua Shen

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments Project page: https://aim-uofa.github.io/Framer/

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.13832 2024-10-29 cs.CV cs.GR 57%

VidPanos: Generative Panoramic Videos from Casual Panning Videos

Jingwei Ma, Erika Lu, Roni Paiss, Shiran Zada, Aleksander Holynski, Tali Dekel, Brian Curless, Michael Rubinstein, Forrester Cole

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments Project page at https://vidpanos.github.io/. To appear at SIGGRAPH Asia 2024 (conference track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.05799 2024-10-29 cs.CV 57%

SeeClear: Semantic Distillation Enhances Pixel Condensation for Video Super-Resolution

Qi Tang, Yao Zhao, Meiqin Liu, Chao Yao

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments Accepted to NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.07155 2024-10-10 cs.CV 57%

Trans4D: Realistic Geometry-Aware Transition for Compositional Text-to-4D Synthesis

Bohan Zeng, Ling Yang, Siyu Li, Jiaming Liu, Zixiang Zhang, Juanxi Tian, Kaixin Zhu, Yongzhen Guo, Fu-Yun Wang, Minkai Xu, Stefano Ermon, Wentao Zhang

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments Project: https://github.com/YangLing0818/Trans4D

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.20320 2024-10-10 cs.CV cs.AI cs.LG 57%

Improving the Training of Rectified Flows

Sangyun Lee, Zinan Lin, Giulia Fanti

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments NeurIPS2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.00262 2024-10-02 cs.CV 57%

ImmersePro: End-to-End Stereo Video Synthesis Via Implicit Disparity Learning

Jian Shi, Zhenyu Li, Peter Wonka

专题命中 视频生成 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏