arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

视频大模型

视频理解、视频生成、视频语言模型和时序视觉推理。

共收录 2143 信号源:cs.CV, eess.IV, cs.MM

1. 视频生成 2143 篇

2409.13268 2024-09-23 cs.CV 57%

JoyHallo: Digital human model for Mandarin

Sheng Shi, Xuyang Cao, Jun Zhao, Guoxin Wang

专题命中 视频生成 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.01256 2024-09-17 cs.CV cs.CL 57%

VideoStudio: Generating Consistent-Content and Multi-Scene Videos

Fuchen Long, Zhaofan Qiu, Ting Yao, Tao Mei

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments ECCV 2024. Source code is available at https://github.com/FuchenUSTC/VideoStudio

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.06322 2024-09-11 cs.CV 57%

G3PT: Unleash the power of Autoregressive Modeling in 3D Generation via Cross-scale Querying Transformer

Jinzhi Zhang, Feng Xiong, Mu Xu

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments 9 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.08459 2024-08-22 cs.CL cs.CV cs.LG 57%

JPEG-LM: LLMs as Image Generators with Canonical Codec Representations

Xiaochuang Han, Marjan Ghazvininejad, Pang Wei Koh, Yulia Tsvetkov

专题命中 视频生成 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.06174 2024-08-22 cs.CV 57%

The Tug-of-War Between Deepfake Generation and Detection

Hannah Lee, Changyeon Lee, Kevin Farhat, Lin Qiu, Steve Geluso, Aerin Kim, Oren Etzioni

专题命中 视频生成 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.05477 2024-08-21 cs.CV 57%

Scene123: One Prompt to 3D Scene Generation via Video-Assisted and Consistency-Enhanced MAE

Yiying Yang, Fukun Yin, Jiayuan Fan, Xin Chen, Wanzhang Li, Gang Yu

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments arXiv admin note: text overlap with arXiv:2305.11588 by other authors

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.07398 2024-08-12 cs.CV cs.AI cs.LG cs.RO 57%

Visual Representation Learning with Stochastic Frame Prediction

Huiwon Jang, Dongyoung Kim, Junsu Kim, Jinwoo Shin, Pieter Abbeel, Younggyo Seo

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments International Conference on Machine Learning (ICML) 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.21475 2024-08-01 cs.CV cs.AI 57%

Fine-gained Zero-shot Video Sampling

Dengsheng Chen, Jie Hu, Xiaoming Wei, Enhua Wu

专题命中 视频生成 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.18955 2024-07-30 cs.CV 57%

Real Face Video Animation Platform

Xiaokai Chen, Xuan Liu, Donglin Di, Yongjia Ma, Wei Chen, Tonghua Su

专题命中 视频生成 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.00801 2024-07-23 cs.CV 57%

$R^2$-Tuning: Efficient Image-to-Video Transfer Learning for Video Temporal Grounding

Ye Liu, Jixuan He, Wanhua Li, Junsik Kim, Donglai Wei, Hanspeter Pfister, Chang Wen Chen

专题命中 视频生成 :video understanding(abstract);分类 cs.CV

Comments ECCV 2024 Camera Ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.14582 2024-07-19 cs.CV cs.AI 57%

PoseCrafter: One-Shot Personalized Video Synthesis Following Flexible Pose Control

Yong Zhong, Min Zhao, Zebin You, Xiaofeng Yu, Changwang Zhang, Chongxuan Li

专题命中 视频生成 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.12798 2024-07-19 cs.CV 57%

Multi-Granularity and Multi-modal Feature Interaction Approach for Text Video Retrieval

Wenjun Li, Shudong Wang, Dong Zhao, Shenghui Xu, Zhaoming Pan, Zhimin Zhang

专题命中 视频生成 :text-to-video(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.12002 2024-07-16 cs.CV cs.AI 57%

DreamMotion: Space-Time Self-Similar Score Distillation for Zero-Shot Video Editing

Hyeonho Jeong, Jinho Chang, Geon Yeong Park, Jong Chul Ye

专题命中 视频生成 :video diffusion(abstract);分类 cs.CV

Comments Accepted to ECCV 2024, Project page: https://hyeonho99.github.io/dreammotion/

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.06871 2024-07-10 cs.CV 57%

Rethinking Image-to-Video Adaptation: An Object-centric Perspective

Rui Qian, Shuangrui Ding, Dahua Lin

专题命中 视频生成 :video understanding(abstract);分类 cs.CV

Comments ECCV 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.16849 2024-07-09 cs.CV 57%

Sync4D: Video Guided Controllable Dynamics for Physics-Based 4D Generation

Zhoujie Fu, Jiacheng Wei, Wenhao Shen, Chaoyue Song, Xiaofeng Yang, Fayao Liu, Xulei Yang, Guosheng Lin

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments Our project page: https://sync4dphys.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.16693 2024-06-28 cs.CV 57%

I2V-Adapter: A General Image-to-Video Adapter for Diffusion Models

Xun Guo, Mingwu Zheng, Liang Hou, Yuan Gao, Yufan Deng, Pengfei Wan, Di Zhang, Yufan Liu, Weiming Hu, Zhengjun Zha, Haibin Huang, Chongyang Ma

专题命中 视频生成 :text-to-video(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.06470 2024-06-21 cs.CV cs.AI 57%

Qualitative Failures of Image Generation Models and Their Application in Detecting Deepfakes

Ali Borji

专题命中 视频生成 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.11331 2024-06-18 cs.CV cs.IR cs.LG 57%

They're All Doctors: Synthesizing Diverse Counterfactuals to Mitigate Associative Bias

Salma Abdel Magid, Jui-Hsien Wang, Kushal Kafle, Hanspeter Pfister

专题命中 视频生成 :text-to-video(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.11259 2024-06-18 cs.CV cs.AI 57%

NLDF: Neural Light Dynamic Fields for Efficient 3D Talking Head Generation

Niu Guanchen

专题命中 视频生成 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2005.10638 2024-06-11 cs.LG eess.IV stat.ML 57%

Recent Developments Combining Ensemble Smoother and Deep Generative Networks for Facies History Matching

Smith W. A. Canchumuni, Jose D. B. Castro, Júlia Potratz, Alexandre A. Emerick, Marco Aurelio C. Pacheco

专题命中 视频生成 :video generation(abstract);分类 eess.IV

Comments 46 pages, 26 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.11568 2024-06-06 cs.CV 57%

EffiVED:Efficient Video Editing via Text-instruction Diffusion Models

Zhenghao Zhang, Zuozhuo Dai, Long Qin, Weizhi Wang

专题命中 视频生成 :text-to-video(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.13951 2024-05-24 cs.CV 57%

Text Prompting for Multi-Concept Video Customization by Autoregressive Generation

Divya Kothandaraman, Kihyuk Sohn, Ruben Villegas, Paul Voigtlaender, Dinesh Manocha, Mohammad Babaeizadeh

专题命中 视频生成 :text-to-video(abstract);分类 cs.CV

Comments Paper accepted to AI4CC Workshop at CVPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.01590 2024-05-14 cs.CV 57%

NeuroCine: Decoding Vivid Video Sequences from Human Brain Activties

Jingyuan Sun, Mingxiao Li, Zijiao Chen, Marie-Francine Moens

专题命中 视频生成 :video generation(abstract);分类 cs.CV

Comments under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.16687 2024-05-08 cs.CV 57%

NTIRE 2024 Quality Assessment of AI-Generated Content Challenge

Xiaohong Liu, Xiongkuo Min, Guangtao Zhai, Chunyi Li, Tengchuan Kou, Wei Sun, Haoning Wu, Yixuan Gao, Yuqin Cao, Zicheng Zhang, Xiele Wu, Radu Timofte, Fei Peng, Huiyuan Fu, Anlong Ming, Chuanming Wang, Huadong Ma, Shuai He, Zifei Dou, Shu Chen, Huacong Zhang, Haiyi Xie, Chengwei Wang, Baoying Chen, Jishen Zeng, Jianquan Yang, Weigang Wang, Xi Fang, Xiaoxin Lv, Jun Yan, Tianwu Zhi, Yabin Zhang, Yaohui Li, Yang Li, Jingwen Xu, Jianzhao Liu, Yiting Liao, Junlin Li, Zihao Yu, Yiting Lu, Xin Li, Hossein Motamednia, S. Farhad Hosseini-Benvidi, Fengbin Guan, Ahmad Mahmoudi-Aznaveh, Azadeh Mansouri, Ganzorig Gankhuyag, Kihwan Yoon, Yifang Xu, Haotian Fan, Fangyuan Kong, Shiling Zhao, Weifeng Dong, Haibing Yin, Li Zhu, Zhiling Wang, Bingchen Huang, Avinab Saha, Sandeep Mishra, Shashank Gupta, Rajesh Sureddi, Oindrila Saha, Luigi Celona, Simone Bianco, Paolo Napoletano, Raimondo Schettini, Junfeng Yang, Jing Fu, Wei Zhang, Wenzhi Cao, Limei Liu, Han Peng, Weijun Yuan, Zhan Li, Yihang Cheng, Yifan Deng, Haohui Li, Bowen Qu, Yao Li, Shuqing Luo, Shunzhou Wang, Wei Gao, Zihao Lu, Marcos V. Conde, Xinrui Wang, Zhibo Chen, Ruling Liao, Yan Ye, Qiulin Wang, Bing Li, Zhaokun Zhou, Miao Geng, Rui Chen, Xin Tao, Xiaoyu Liang, Shangkun Sun, Xingyuan Ma, Jiaze Li, Mengduo Yang, Haoran Xu, Jie Zhou, Shiding Zhu, Bohan Yu, Pengfei Chen, Xinrui Xu, Jiabin Shen, Zhichao Duan, Erfan Asadi, Jiahe Liu, Qi Yan, Youran Qu, Xiaohui Zeng, Lele Wang, Renjie Liao

专题命中 视频生成 :text-to-video(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.14385 2024-05-07 cs.DC cs.LG cs.MM 57%

Generative AI Beyond LLMs: System Implications of Multi-Modal Generation

Alicia Golden, Samuel Hsia, Fei Sun, Bilge Acun, Basil Hosmer, Yejin Lee, Zachary DeVito, Jeff Johnson, Gu-Yeon Wei, David Brooks, Carole-Jean Wu

专题命中 视频生成 :text-to-video(abstract);分类 cs.MM

Comments Published at 2024 IEEE International Symposium on Performance Analysis of Systems and Software (ISPASS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.17608 2024-04-30 cs.SD cs.AI cs.CV cs.LG eess.AS 57%

Synthesizing Audio from Silent Video using Sequence to Sequence Modeling

Hugo Garrido-Lestache Belinchon, Helina Mulugeta, Adam Haile

专题命中 视频生成 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.13573 2024-04-30 cs.CV 57%

Exploring AIGC Video Quality: A Focus on Visual Harmony, Video-Text Consistency and Domain Distribution Gap

Bowen Qu, Xiaoyu Liang, Shangkun Sun, Wei Gao

专题命中 视频生成 :text-to-video(abstract);分类 cs.CV

Comments 9 pages, 3 figures, 3 tables. Accepted by CVPR2024 Workshop (3rd place winner of NTIRE2024 Quality Assessment for AI-Generated Content - Track 2 Video)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.16305 2024-04-29 cs.MM cs.SD eess.AS 57%

Semantically consistent Video-to-Audio Generation using Multimodal Language Large Model

Gehui Chen, Guan'an Wang, Xiaowen Huang, Jitao Sang

专题命中 视频生成 :video generation(abstract);分类 cs.MM

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.13299 2024-04-23 cs.CV 57%

PCQA: A Strong Baseline for AIGC Quality Assessment Based on Prompt Condition

Xi Fang, Weigang Wang, Xiaoxin Lv, Jun Yan

专题命中 视频生成 :text-to-video(abstract);分类 cs.CV

Comments Published in CVPR-2024's NTIRE: New Trends in Image Restoration and Enhancement workshop and challenges

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.16993 2024-03-26 cs.CV 57%

Comp4D: LLM-Guided Compositional 4D Scene Generation

Dejia Xu, Hanwen Liang, Neel P. Bhatt, Hezhen Hu, Hanxue Liang, Konstantinos N. Plataniotis, Zhangyang Wang

专题命中 视频生成 :text-to-video(abstract);分类 cs.CV

Comments Project page: https://vita-group.github.io/Comp4D/

详情

展开后加载摘要…

URL PDF HTML 收藏