arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

视频大模型

视频理解、视频生成、视频语言模型和时序视觉推理。

共收录 6759 信号源:cs.CV, eess.IV, cs.MM

1. 视频理解 1375 篇

1804.11228 2019-09-17 cs.CV 57%

Dilated Temporal Relational Adversarial Network for Generic Video Summarization

Yujia Zhang, Michael Kampffmeyer, Xiaodan Liang, Dingwen Zhang, Min Tan, Eric P. Xing

专题命中 视频理解 :video understanding(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
1904.04289 2019-09-02 cs.CV 57%

SCSampler: Sampling Salient Clips from Video for Efficient Action Recognition

Bruno Korbar, Du Tran, Lorenzo Torresani

专题命中 视频理解 :long video(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
1907.11117 2019-08-02 cs.CV 57%

Learning Visual Actions Using Multiple Verb-Only Labels

Michael Wray, Dima Damen

专题命中 视频理解 :text-to-video(abstract);分类 cs.CV

Comments Accepted at BMVC 2019. More information can be found at https://mwray.github.io/MVOL/. Annotations can be found at https://github.com/mwray/Multi-Verb-Labels

详情

展开后加载摘要…

URL PDF HTML 收藏
1906.01524 2019-06-05 cs.CV cs.GR cs.LG 57%

Text-based Editing of Talking-head Video

Ohad Fried, Ayush Tewari, Michael Zollhöfer, Adam Finkelstein, Eli Shechtman, Dan B Goldman, Kyle Genova, Zeyu Jin, Christian Theobalt, Maneesh Agrawala

专题命中 视频理解 :video generation(abstract);分类 cs.CV

Comments A version with higher resolution images can be downloaded from the authors' website

详情

展开后加载摘要…

URL PDF HTML 收藏
1905.10240 2019-06-05 cs.CV cs.AI cs.LG 57%

From Here to There: Video Inbetweening Using Direct 3D Convolutions

Yunpeng Li, Dominik Roblek, Marco Tagliasacchi

专题命中 视频理解 :video generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
1906.00377 2019-06-04 cs.CV 57%

Hierarchical Video Frame Sequence Representation with Deep Convolutional Graph Network

Feng Mao, Xiang Wu, Hui Xue, Rong Zhang

专题命中 视频理解 :video understanding(abstract);分类 cs.CV

Comments ECCV 2018

Journal ref ECCV 2018 Workshops pp 262-270

详情

展开后加载摘要…

URL PDF HTML 收藏
1905.08711 2019-05-22 cs.CV cs.AI cs.LG 57%

Lightweight Network Architecture for Real-Time Action Recognition

Alexander Kozlov, Vadim Andronov, Yana Gritsenko

专题命中 视频理解 :video understanding(abstract);分类 cs.CV

Comments 8 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
1812.05637 2019-05-08 cs.CV 57%

Dynamic Graph Modules for Modeling Object-Object Interactions in Activity Recognition

Hao Huang, Luowei Zhou, Wei Zhang, Jason J. Corso, Chenliang Xu

专题命中 视频理解 :video understanding(abstract);分类 cs.CV

Comments 14 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
1905.00561 2019-05-03 cs.CV 57%

Large-scale weakly-supervised pre-training for video action recognition

Deepti Ghadiyaram, Matt Feiszli, Du Tran, Xueting Yan, Heng Wang, Dhruv Mahajan

专题命中 视频理解 :long video(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
1812.01461 2019-04-05 cs.CV 57%

The Visual Centrifuge: Model-Free Layered Video Representations

Jean-Baptiste Alayrac, João Carreira, Andrew Zisserman

专题命中 视频理解 :video understanding(abstract);分类 cs.CV

Comments Appears in: 2019 IEEE Conference on Computer Vision and Pattern Recognition (CVPR 2019). This arXiv contains the CVPR Camera Ready version of the paper (although we have included larger figures) as well as an appendix detailing the model architecture

详情

展开后加载摘要…

URL PDF HTML 收藏
1811.11387 2019-04-05 cs.CV 57%

Self-Supervised Spatiotemporal Feature Learning via Video Rotation Prediction

Longlong Jing, Xiaodong Yang, Jingen Liu, Yingli Tian

专题命中 视频理解 :video understanding(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
1903.00110 2019-03-04 cs.CV 57%

Video Summarization via Actionness Ranking

Mohamed Elfeki, Ali Borji

专题命中 视频理解 :long video(abstract);分类 cs.CV

Journal ref Published in WACV-2019 as an Oral

详情

展开后加载摘要…

URL PDF HTML 收藏
1809.08854 2018-12-31 cs.CV cs.LG 57%

A Framework towards Domain Specific Video Summarization

Vishal Kaushal, Sandeep Subramanian, Suraj Kothawade, Rishabh Iyer, Ganesh Ramakrishnan

专题命中 视频理解 :long video(abstract);分类 cs.CV

Comments Accepted to WACV 2019

详情

展开后加载摘要…

URL PDF HTML 收藏
1812.02872 2018-12-10 cs.CV 57%

An Attempt towards Interpretable Audio-Visual Video Captioning

Yapeng Tian, Chenxiao Guan, Justin Goodman, Marc Moore, Chenliang Xu

专题命中 视频理解 :video understanding(abstract);分类 cs.CV

Comments 11 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
1811.11167 2018-11-28 cs.CV 57%

Integrated Object Detection and Tracking with Tracklet-Conditioned Detection

Zheng Zhang, Dazhi Cheng, Xizhou Zhu, Stephen Lin, Jifeng Dai

专题命中 视频理解 :video understanding(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
1811.05014 2018-11-14 cs.CV 57%

NeXtVLAD: An Efficient Neural Network to Aggregate Frame-level Features for Large-scale Video Classification

Rongcheng Lin, Jing Xiao, Jianping Fan

专题命中 视频理解 :video understanding(abstract);分类 cs.CV

Comments ECCV 2018 workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
1810.02074 2018-10-05 cs.CV 57%

Unsupervised Adversarial Visual Level Domain Adaptation for Learning Video Object Detectors from Images

Avisek Lahiri, Charan Reddy, Prabir Kumar Biswas

专题命中 视频理解 :video understanding(abstract);分类 cs.CV

Comments * First two authors contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
1810.00530 2018-10-02 cs.CV 57%

Learnable Pooling Methods for Video Classification

Sebastian Kmiec, Juhan Bae, Ruijian An

专题命中 视频理解 :video understanding(abstract);分类 cs.CV

Comments Presented at Youtube 8M ECCV18 Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
1809.07895 2018-09-24 cs.CV 57%

Large-Scale Video Classification with Feature Space Augmentation coupled with Learned Label Relations and Ensembling

Choongyeun Cho, Benjamin Antin, Sanchit Arora, Shwan Ashrafi, Peilin Duan, Dang The Huynh, Lee James, Hang Tuan Nguyen, Mojtaba Solgi, Cuong Van Than

专题命中 视频理解 :video understanding(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
1806.03863 2018-09-06 cs.CV 57%

Massively Parallel Video Networks

Joao Carreira, Viorica Patraucean, Laurent Mazare, Andrew Zisserman, Simon Osindero

专题命中 视频理解 :video understanding(abstract);分类 cs.CV

Comments Fixed typos in densenet model definition in appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
1808.05085 2018-08-16 cs.CV 57%

Temporal Sequence Distillation: Towards Few-Frame Action Recognition in Videos

Zhaoyang Zhang, Zhanghui Kuang, Ping Luo, Litong Feng, Wei Zhang

专题命中 视频理解 :long video(abstract);分类 cs.CV

Comments Accepted by ACM Multimedia

详情

展开后加载摘要…

URL PDF HTML 收藏
1807.06677 2018-07-19 cs.CV 57%

Query-Conditioned Three-Player Adversarial Network for Video Summarization

Yujia Zhang, Michael Kampffmeyer, Xiaodan Liang, Min Tan, Eric P. Xing

专题命中 视频理解 :video understanding(abstract);分类 cs.CV

Comments 13 pages, 3 figures, BMVC 2018

详情

展开后加载摘要…

URL PDF HTML 收藏
1806.10319 2018-06-28 cs.CV 57%

Exploiting Spatial-Temporal Modelling and Multi-Modal Fusion for Human Action Recognition

Dongliang He, Fu Li, Qijie Zhao, Xiang Long, Yi Fu, Shilei Wen

专题命中 视频理解 :video understanding(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
1806.07011 2018-06-20 cs.CV cs.AI cs.LG 57%

VirtualHome: Simulating Household Activities via Programs

Xavier Puig, Kevin Ra, Marko Boben, Jiaman Li, Tingwu Wang, Sanja Fidler, Antonio Torralba

专题命中 视频理解 :video understanding(abstract);分类 cs.CV

Comments CVPR 2018 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
1805.07550 2018-05-22 cs.CV 57%

DenseImage Network: Video Spatial-Temporal Evolution Encoding and Understanding

Xiaokai Chen, Ke Gao

专题命中 视频理解 :video understanding(abstract);分类 cs.CV

Comments 7 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
1805.06374 2018-05-22 cs.CV 57%

Fast Retinomorphic Event Stream for Video Recognition and Reinforcement Learning

Wanjia Liu, Huaijin Chen, Rishab Goel, Yuzhong Huang, Ashok Veeraraghavan, Ankit Patel

专题命中 视频理解 :video understanding(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
1804.05448 2018-04-17 cs.CL cs.AI cs.CV 57%

Watch, Listen, and Describe: Globally and Locally Aligned Cross-Modal Attentions for Video Captioning

Xin Wang, Yuan-Fang Wang, William Yang Wang

专题命中 视频理解 :video understanding(abstract);分类 cs.CV

Comments NAACL 2018

详情

展开后加载摘要…

URL PDF HTML 收藏
1706.06905 2018-03-06 cs.CV 57%

Learnable pooling with Context Gating for video classification

Antoine Miech, Ivan Laptev, Josef Sivic

专题命中 视频理解 :video understanding(abstract);分类 cs.CV

Comments Presented at Youtube 8M CVPR17 Workshop. Kaggle Winning model. Under review for TPAMI

详情

展开后加载摘要…

URL PDF HTML 收藏
1709.05436 2018-02-06 cs.CV cs.AI 57%

Scene-centric Joint Parsing of Cross-view Videos

Hang Qi, Yuanlu Xu, Tao Yuan, Tianfu Wu, Song-Chun Zhu

专题命中 视频理解 :video understanding(abstract);分类 cs.CV

Comments Accepted by AAAI 2018

详情

展开后加载摘要…

URL PDF HTML 收藏
1708.03795 2017-12-18 cs.CV 57%

Kill Two Birds With One Stone: Boosting Both Object Detection Accuracy and Speed With adaptive Patch-of-Interest Composition

Shihao Zhang, Weiyao Lin, Ping Lu, Weihua Li, Shuo Deng

专题命中 视频理解 :video understanding(abstract);分类 cs.CV

Comments The project page for this paper is available at http://min.sjtu.edu.cn/lwydemo/Dete/demo/detection.html

详情

展开后加载摘要…

URL PDF HTML 收藏