Associated Spatio-Temporal Capsule Network for Gait Recognition
专题命中 视频多模态 :multimodal(abstract);分类 cs.CV、cs.AI
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 视频多模态 :multimodal(abstract);分类 cs.CV、cs.AI
专题命中 视频多模态 :multimodal(abstract);分类 cs.CV、cs.CL
Comments 16 Pages, 8 Figures, 4 Tables, +Supp Mats
专题命中 视频多模态 :multimodal(abstract);分类 cs.CV、cs.CL
Comments Accepted at AAAI 2021
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV、cs.AI
Comments 21 pages, 6 figures, 3 tables. arXiv admin note: substantial text overlap with arXiv:2011.07658
专题命中 视频多模态 :multimodal(abstract);分类 cs.CL、cs.AI
Comments 10 pages, 4 figures
专题命中 视频多模态 :multimodal(abstract);分类 cs.CV、cs.CL
Comments 20+17 pages, 33 figures; added appendix with additional language results
专题命中 视频多模态 :multimodal(abstract);分类 cs.CV、cs.MM
Comments arXiv admin note: text overlap with arXiv:1910.11482
专题命中 视频多模态 :multimodal(abstract);分类 cs.CV、cs.CL
专题命中 视频多模态 :audio-visual(abstract);分类 cs.CV、cs.CL
Comments Accepted at ACL 2020 (Short Paper)
Journal ref Association for Computational Linguistics (2020) 5842-5848
专题命中 视频多模态 :multimodal(abstract);分类 cs.CV、cs.CL
Comments To appear at ACL 2020
专题命中 视频多模态 :cross-modal(abstract);分类 cs.CV、cs.CL
Comments Accepted to ICIP 2020
专题命中 视频多模态 :multimodal(abstract);分类 cs.CV、cs.MM
Comments Published in IEEE Transactions on Multimedia
Journal ref J. Li, Y. Wong, Q. Zhao and M. S. Kankanhalli, "Video Storytelling: Textual Summaries for Events," in IEEE Transactions on Multimedia, 2019
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV、cs.CL
Comments CVPR20 camera-ready including appendix
专题命中 视频多模态 :multimodal(abstract);分类 cs.CV、cs.CL
Comments This is a research report done during master's studies
专题命中 视频多模态 :multimodal(abstract);分类 cs.CV、cs.CL
专题命中 视频多模态 :multimodal(abstract);分类 cs.CV、eess.AS
Comments Accepted for the Fifth International Workshop on Egocentric Perception, Interaction and Computing (EPIC) at the International Conference on Computer Vision (ICCV) 2019
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV、cs.MM
专题命中 视频多模态 :cross-modal(abstract);分类 cs.CV、cs.AI
Comments ICCV 2019 camera ready
专题命中 视频多模态 :audio-visual(abstract);分类 cs.CV、cs.AI
Comments Accepted to CVPR Blockchain Workshop 2019
专题命中 视频多模态 :cross-modal(abstract);分类 cs.CV、cs.MM
专题命中 视频多模态 :multimodal(abstract);分类 cs.CV、cs.AI
Comments To be published in IEEE Transactions on Affective Computing. 20 pages, 7 figures, 6 tables
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV、cs.AI
Comments ITSC'17
专题命中 视频多模态 :multimodal(abstract);分类 cs.CV、cs.CL
Comments accepted paper at ICCV 2017
专题命中 视频多模态 :multimodal(abstract);分类 cs.CV、cs.CL
Comments https://memexqa.cs.cmu.edu/
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV、cs.MM
Comments Proceedings of the 6th International Workshop on Audio/Visual Emotion Challenge, AVEC'16, co-located with the 24th ACM International Conference on Multimedia, MM 2016, pages 3-10, Amsterdam, The Netherlands, October 2016. ACM
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV、cs.MM
专题命中 视频多模态 :multimodal(abstract);分类 cs.CV、cs.MM
专题命中 视频多模态 :multimodal(abstract);分类 cs.CV、cs.MM
专题命中 视频多模态 :audio-visual(abstract);分类 cs.CV、cs.MM
Comments 4 pages, IGS 2013 Conference; IGS 2013
机构 * New York University(纽约大学) ; Stanford University(斯坦福大学)
专题命中 视频多模态 :multimodal(abstract);分类 cs.CV;MLLM(comments)
Comments Website: https://cambrian-mllm.github.io/