arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

视频大模型

视频理解、视频生成、视频语言模型和时序视觉推理。

共收录 6759 信号源:cs.CV, eess.IV, cs.MM

1. 视频理解 1375 篇

2210.10039 2022-10-19 cs.CV cs.CY cs.LG 57%

How Would The Viewer Feel? Estimating Wellbeing From Video Scenarios

Mantas Mazeika, Eric Tang, Andy Zou, Steven Basart, Jun Shern Chan, Dawn Song, David Forsyth, Jacob Steinhardt, Dan Hendrycks

专题命中 视频理解 :video understanding(abstract);分类 cs.CV

Comments NeurIPS 2022; datasets available at https://github.com/hendrycks/emodiversity/

详情

展开后加载摘要…

URL PDF HTML 收藏
2201.10394 2022-10-11 cs.CV 57%

Capturing Temporal Information in a Single Frame: Channel Sampling Strategies for Action Recognition

Kiyoon Kim, Shreyank N Gowda, Oisin Mac Aodha, Laura Sevilla-Lara

专题命中 视频理解 :video understanding(abstract);分类 cs.CV

Comments BMVC 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.02365 2022-10-06 cs.CV 57%

SoccerNet 2022 Challenges Results

Silvio Giancola, Anthony Cioppa, Adrien Deliège, Floriane Magera, Vladimir Somers, Le Kang, Xin Zhou, Olivier Barnich, Christophe De Vleeschouwer, Alexandre Alahi, Bernard Ghanem, Marc Van Droogenbroeck, Abdulrahman Darwish, Adrien Maglo, Albert Clapés, Andreas Luyts, Andrei Boiarov, Artur Xarles, Astrid Orcesi, Avijit Shah, Baoyu Fan, Bharath Comandur, Chen Chen, Chen Zhang, Chen Zhao, Chengzhi Lin, Cheuk-Yiu Chan, Chun Chuen Hui, Dengjie Li, Fan Yang, Fan Liang, Fang Da, Feng Yan, Fufu Yu, Guanshuo Wang, H. Anthony Chan, He Zhu, Hongwei Kan, Jiaming Chu, Jianming Hu, Jianyang Gu, Jin Chen, João V. B. Soares, Jonas Theiner, Jorge De Corte, José Henrique Brito, Jun Zhang, Junjie Li, Junwei Liang, Leqi Shen, Lin Ma, Lingchi Chen, Miguel Santos Marques, Mike Azatov, Nikita Kasatkin, Ning Wang, Qiong Jia, Quoc Cuong Pham, Ralph Ewerth, Ran Song, Rengang Li, Rikke Gade, Ruben Debien, Runze Zhang, Sangrok Lee, Sergio Escalera, Shan Jiang, Shigeyuki Odashima, Shimin Chen, Shoichi Masui, Shouhong Ding, Sin-wai Chan, Siyu Chen, Tallal El-Shabrawy, Tao He, Thomas B. Moeslund, Wan-Chi Siu, Wei Zhang, Wei Li, Xiangwei Wang, Xiao Tan, Xiaochuan Li, Xiaolin Wei, Xiaoqing Ye, Xing Liu, Xinying Wang, Yandong Guo, Yaqian Zhao, Yi Yu, Yingying Li, Yue He, Yujie Zhong, Zhenhua Guo, Zhiheng Li

专题命中 视频理解 :video understanding(abstract);分类 cs.CV

Comments Accepted at ACM MMSports 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.00307 2022-10-06 cs.CV 57%

Temporal Perceiver: A General Architecture for Arbitrary Boundary Detection

Jing Tan, Yuhong Wang, Gangshan Wu, Limin Wang

专题命中 视频理解 :video understanding(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2209.08956 2022-09-20 cs.CV 57%

Panoramic Vision Transformer for Saliency Detection in 360° Videos

Heeseung Yun, Sehun Lee, Gunhee Kim

专题命中 视频理解 :video understanding(abstract);分类 cs.CV

Comments Published to ECCV2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2209.04242 2022-09-12 cs.CV 57%

EchoCoTr: Estimation of the Left Ventricular Ejection Fraction from Spatiotemporal Echocardiography

Rand Muhtaseb, Mohammad Yaqub

专题命中 视频理解 :video understanding(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.11307 2022-09-02 cs.CV cs.AI cs.CL 57%

Visual Subtitle Feature Enhanced Video Outline Generation

Qi Lv, Ziqiang Cao, Wenrui Xie, Derui Wang, Jingwen Wang, Zhiwei Hu, Tangkun Zhang, Ba Yuan, Yuanhang Li, Min Cao, Wenjie Li, Sujian Li, Guohong Fu

专题命中 视频理解 :video understanding(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2202.07925 2022-08-30 cs.CV 57%

ActionFormer: Localizing Moments of Actions with Transformers

Chenlin Zhang, Jianxin Wu, Yin Li

专题命中 视频理解 :video understanding(abstract);分类 cs.CV

Comments Accepted to ECCV 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.06105 2022-08-15 cs.CV 57%

Motion Sensitive Contrastive Learning for Self-supervised Video Representation

Jingcheng Ni, Nan Zhou, Jie Qin, Qian Wu, Junqi Liu, Boxun Li, Di Huang

专题命中 视频理解 :video understanding(abstract);分类 cs.CV

Comments Accepted by ECCV2022, 17 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.05375 2022-08-11 cs.CV cs.AI 57%

Exploring Anchor-based Detection for Ego4D Natural Language Query

Sipeng Zheng, Qi Zhang, Bei Liu, Qin Jin, Jianlong Fu

专题命中 视频理解 :video understanding(abstract);分类 cs.CV

Comments CVPR 2022 Ego4D Workshop NLQ Challenge

详情

展开后加载摘要…

URL PDF HTML 收藏
2207.12795 2022-07-27 cs.CV cs.LG 57%

Static and Dynamic Concepts for Self-supervised Video Representation Learning

Rui Qian, Shuangrui Ding, Xian Liu, Dahua Lin

专题命中 视频理解 :video understanding(abstract);分类 cs.CV

Comments ECCV 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2207.01375 2022-07-21 cs.CV cs.AI 57%

GraphVid: It Only Takes a Few Nodes to Understand a Video

Eitan Kosman, Dotan Di Castro

专题命中 视频理解 :video understanding(abstract);分类 cs.CV

Comments Accepted to ECCV2022 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2207.08001 2022-07-19 cs.CV 57%

SVGraph: Learning Semantic Graphs from Instructional Videos

Madeline C. Schiappa, Yogesh S. Rawat

专题命中 视频理解 :video understanding(abstract);分类 cs.CV

Comments 20 pages, 27 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2207.06261 2022-07-14 cs.CV cs.LG 57%

Is Appearance Free Action Recognition Possible?

Filip Ilic, Thomas Pock, Richard P. Wildes

专题命中 视频理解 :video understanding(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2111.07624 2022-07-06 cs.CV 57%

Attention Mechanisms in Computer Vision: A Survey

Meng-Hao Guo, Tian-Xing Xu, Jiang-Jiang Liu, Zheng-Ning Liu, Peng-Tao Jiang, Tai-Jiang Mu, Song-Hai Zhang, Ralph R. Martin, Ming-Ming Cheng, Shi-Min Hu

专题命中 视频理解 :video understanding(abstract);分类 cs.CV

Comments 27 pages, 9 figures

Journal ref Computational Visual Media, 2022, Vol. 8, No. 3, 331-368

详情

展开后加载摘要…

URL PDF HTML 收藏
2206.14555 2022-06-30 cs.CV cs.AI 57%

Technical Report for CVPR 2022 LOVEU AQTC Challenge

Hyeonyu Kim, Jongeun Kim, Jeonghun Kang, Sanguk Park, Dongchan Park, Taehwan Kim

专题命中 视频理解 :video understanding(abstract);分类 cs.CV

Comments 4 pages, 3 figures, technical report for track3 of CVPR 2022 LOVEU challenge

详情

展开后加载摘要…

URL PDF HTML 收藏
2112.13478 2022-06-30 cs.CV 57%

Video Joint Modelling Based on Hierarchical Transformer for Co-summarization

Li Haopeng, Ke Qiuhong, Gong Mingming, Zhang Rui

专题命中 视频理解 :video understanding(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2111.13196 2022-06-22 cs.CV 57%

SwinBERT: End-to-End Transformers with Sparse Attention for Video Captioning

Kevin Lin, Linjie Li, Chung-Ching Lin, Faisal Ahmed, Zhe Gan, Zicheng Liu, Yumao Lu, Lijuan Wang

专题命中 视频理解 :video understanding(abstract);分类 cs.CV

Comments CVPR 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2201.10990 2022-06-20 cs.CV 57%

Learning To Recognize Procedural Activities with Distant Supervision

Xudong Lin, Fabio Petroni, Gedas Bertasius, Marcus Rohrbach, Shih-Fu Chang, Lorenzo Torresani

专题命中 视频理解 :long video(abstract);分类 cs.CV

Comments CVPR 2022. Code will be released here https://github.com/facebookresearch/video-distant-supervision

详情

展开后加载摘要…

URL PDF HTML 收藏
2110.06915 2022-06-13 cs.CV 57%

Object-Region Video Transformers

Roei Herzig, Elad Ben-Avraham, Karttikeya Mangalam, Amir Bar, Gal Chechik, Anna Rohrbach, Trevor Darrell, Amir Globerson

专题命中 视频理解 :video understanding(abstract);分类 cs.CV

Comments CVPR 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2206.02002 2022-06-07 cs.CV cs.LG 57%

CVNets: High Performance Library for Computer Vision

Sachin Mehta, Farzad Abdolhosseini, Mohammad Rastegari

专题命中 视频理解 :video understanding(abstract);分类 cs.CV

Comments Technical report

详情

展开后加载摘要…

URL PDF HTML 收藏
2201.04288 2022-06-01 cs.CV cs.LG 57%

Multiview Transformers for Video Recognition

Shen Yan, Xuehan Xiong, Anurag Arnab, Zhichao Lu, Mi Zhang, Chen Sun, Cordelia Schmid

专题命中 视频理解 :video understanding(abstract);分类 cs.CV

Comments CVPR 2022; arXiv v4: update results on Epic-Kitchens-100

详情

展开后加载摘要…

URL PDF HTML 收藏
2205.01818 2022-05-06 cs.LG cs.AI cs.CL cs.CV eess.AS 57%

i-Code: An Integrative and Composable Multimodal Learning Framework

Ziyi Yang, Yuwei Fang, Chenguang Zhu, Reid Pryzant, Dongdong Chen, Yu Shi, Yichong Xu, Yao Qian, Mei Gao, Yi-Ling Chen, Liyang Lu, Yujia Xie, Robert Gmyr, Noel Codella, Naoyuki Kanda, Bin Xiao, Lu Yuan, Takuya Yoshioka, Michael Zeng, Xuedong Huang

专题命中 视频理解 :video understanding(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2204.12408 2022-04-27 cs.CV 57%

MILES: Visual BERT Pre-training with Injected Language Semantics for Video-text Retrieval

Yuying Ge, Yixiao Ge, Xihui Liu, Alex Jinpeng Wang, Jianping Wu, Ying Shan, Xiaohu Qie, Ping Luo

专题命中 视频理解 :text-to-video(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2204.12293 2022-04-27 cs.CV 57%

Contrastive Language-Action Pre-training for Temporal Localization

Mengmeng Xu, Erhan Gundogdu, Maksim Lapin, Bernard Ghanem, Michael Donoser, Loris Bazzani

专题命中 视频理解 :video understanding(abstract);分类 cs.CV

Comments 18 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2106.14104 2022-04-27 cs.CV 57%

Can An Image Classifier Suffice For Action Recognition?

Quanfu Fan, Chun-Fu, Chen, Rameswar Panda

专题命中 视频理解 :video understanding(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2204.10916 2022-04-26 cs.CV cs.LG 57%

Revealing Occlusions with 4D Neural Fields

Basile Van Hoorick, Purva Tendulkar, Didac Suris, Dennis Park, Simon Stent, Carl Vondrick

专题命中 视频理解 :video understanding(abstract);分类 cs.CV

Comments CVPR 2022 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2204.08874 2022-04-20 cs.CV 57%

Less than Few: Self-Shot Video Instance Segmentation

Pengwan Yang, Yuki M. Asano, Pascal Mettes, Cees G. M. Snoek

专题命中 视频理解 :video understanding(abstract);分类 cs.CV

Comments 25 pages, 5 figures, 13 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2204.08671 2022-04-20 cs.CV 57%

ActAR: Actor-Driven Pose Embeddings for Video Action Recognition

Soufiane Lamghari, Guillaume-Alexandre Bilodeau, Nicolas Saunier

专题命中 视频理解 :video understanding(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2204.03141 2022-04-08 cs.CV cs.AI 57%

Adversarial Machine Learning Attacks Against Video Anomaly Detection Systems

Furkan Mumcu, Keval Doshi, Yasin Yilmaz

专题命中 视频理解 :video understanding(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏