Temporal Perceiving Video-Language Pre-training
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV、cs.AI
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV、cs.AI
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV、cs.AI
专题命中 视频多模态 :multimodal(abstract);分类 cs.CL、cs.AI
Comments to appear at CASE 2022 @ EMNLP 2022
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV、cs.AI
Comments Accepted for WACV 2023. Code: https://github.com/joslefaure/HIT
专题命中 视频多模态 :multimodal(abstract);分类 cs.CV、cs.AI
Comments 54 pages. In Proceedings of Neural Information Processing Systems (NeurIPS) 2022
专题命中 视频多模态 :multimodal(abstract);分类 cs.CV、eess.AS
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV、cs.CL
Comments Accepted paper at the European Conference on Computer Vision (ECCV) 2022
专题命中 视频多模态 :cross-modal(abstract);分类 cs.CV、cs.AI
Comments Accepted by WACV 2023
专题命中 视频多模态 :cross-modal(abstract);分类 cs.CV、cs.AI
Comments EMNLP 2022
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV、cs.AI
Comments Code and data available at https://github.com/notmahi/bet
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV、cs.CL
Comments NeurIPS 2022 Camera-Ready; Project Webpage: https://antoyang.github.io/frozenbilm.html; 25 pages; 5 figures
专题命中 视频多模态 :multimodal(abstract);分类 cs.AI、cs.MM
Comments 10 pages, 5 figures
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV、cs.AI
Comments Masters thesis presented in 2021 at the West University of Timisoara, faculty of Mathematics and Computer Science
专题命中 视频多模态 :cross-modal(abstract);分类 cs.CV、cs.CL
Comments NIPS2022
Journal ref NIPS2022
专题命中 视频多模态 :multimodal(abstract);分类 cs.CV、cs.CL
Comments Preprint of LAVIS technical report
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV、cs.MM
Comments To appear at ECCV 2022
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV、cs.CL
专题命中 视频多模态 :multimodal(abstract);分类 cs.MM、eess.AS
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV、cs.AI
Comments 4 pages, 3 figures, technical report for track3 of CVPR 2022 LOVEU challenge
专题命中 视频多模态 :cross-modal(abstract);分类 cs.CV、cs.MM
Comments 4 pages, 2 figures
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV、cs.CL
Comments Updated vIoU results compared to the CVPR'22 camera-ready version; 17 pages; 8 figures
专题命中 视频多模态 :cross-modal(abstract);分类 cs.CV、cs.MM
Comments Accepted by CVPR 2022
专题命中 视频多模态 :cross-modal(abstract);分类 cs.CV、cs.MM
Comments accepted by IJCAI-22, Codes are available at https://github.com/shuoyang129/EAMAT
专题命中 视频多模态 :multimodal(abstract);分类 cs.CV、cs.AI
Comments Accepted by IJCAI 2022. arXiv admin note: text overlap with arXiv:2109.04735
专题命中 视频多模态 :cross-modal(abstract);分类 cs.CV、cs.CL
Comments Submitted to IEEE TMM; Code is available at https://github.com/ZiyueWu59/CCA
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV、cs.AI
专题命中 视频多模态 :audio-visual(abstract);分类 cs.CV、cs.AI
Comments To appear in the Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), 2022. This version updates the baseline result numbers for the Hands and Objects benchmark (appendix)
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV、cs.AI
Comments 7 pages (main), 10 pages (appendix) and to be appeared in AAAI2022
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV、cs.MM
专题命中 视频多模态 :multimodal(abstract);分类 cs.CV、cs.AI
Comments Accepted by TPAMI in Dec 2021; extension of NeurIPS2020 Blind Video Temporal Consistency via Deep Video Prior. arXiv admin note: substantial text overlap with arXiv:2010.11838