ViMGuard: A Novel Multi-Modal System for Video Misinformation Guarding
专题命中 视频多模态 :multi-modal(title);分类 cs.CL
Comments 7 pages, 2 figures
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 视频多模态 :multi-modal(title);分类 cs.CL
Comments 7 pages, 2 figures
专题命中 视频多模态 :multimodal(title);分类 cs.CL
Comments Accepted to Findings of EMNLP 2024
专题命中 视频多模态 :multimodal(title);分类 cs.CV
Comments 7 pages, 4 figures, 1 table
专题命中 视频多模态 :multimodal(title);分类 cs.CL
Comments Accepted Archival Paper for the CPSS Workshop at KONVENS 2024. Camera Ready Submission
专题命中 视频多模态 :cross-modal(title);分类 cs.CV
Comments Accepted in ECCV2024
专题命中 视频多模态 :multimodal(title);分类 cs.CV
Comments a technical report about video understanding (accepted to ECCV2024)
专题命中 视频多模态 :multi-modal(title);分类 cs.CV
Comments CVPR2024
Journal ref CVPR2024
专题命中 视频多模态 :multi-modal(title);分类 cs.CV
Comments cvpr2024 poster (highlight), code at https://github.com/synsin0/StreamingFlow
专题命中 视频多模态 :multi-modal(title);分类 cs.AI
Comments 2023 32nd IEEE International Conference on Robot and Human Interactive Communication (RO-MAN)
专题命中 视频多模态 :multi-modal(title);分类 cs.CV
Comments 11 pages, 1 figure
专题命中 视频多模态 :multi-modal(title);分类 cs.AI
Comments ICML-2023 Camera Ready Version
专题命中 视频多模态 :multi-modal(title);分类 cs.CV
专题命中 视频多模态 :multi-modal(title);分类 cs.AI
Journal ref IEEE RO-MAN 2023, 32nd IEEE International conference on Robot and Human Interactive Communication; Workshop Human-Robot Interaction for Explainability in Robotics, Busan, Korea, August 28-31, 2023
专题命中 视频多模态 :multimodal(title);分类 cs.CV
Comments 8 pages, 7 figures, to be published in IROS 2022
专题命中 视频多模态 :cross-modal(title);分类 cs.CV
Comments 12 pages, 8 figures
专题命中 视频多模态 :multimodal(title);分类 cs.CV
Comments CVPR 2018
Journal ref Proc. IEEE/CVF Conf. Comp. Vis. Patt. Rec. (CVPR) pp. 4914 - 4923 (2018)
专题命中 视频多模态 :multi-modal(title);分类 cs.CV
Comments Accepted at ICCV 2023
专题命中 视频多模态 :multimodal(title);分类 cs.CV
Comments 22 pages, 8 figures and 13 tables
专题命中 视频多模态 :multi-modal(title);分类 cs.CV
Comments 10 pages, 4 figures. Accepted for publication in IEEE Transactions on Biomedical Engineering
专题命中 视频多模态 :multimodal(title);分类 cs.CV
Comments 9 pages,6 figures
专题命中 视频多模态 :multi-modal(title);分类 cs.CL
Comments To appear at EMNLP 2022 findings
专题命中 视频多模态 :cross-modal(title);分类 cs.CV
Comments 8 pages, 9 figures, 5 tables. Presented at IROS 2022
专题命中 视频多模态 :multimodal(title);分类 cs.CV
Comments Accepted Oral Presentation at CVPR 2022 MultiEarth
专题命中 视频多模态 :multimodal(title);分类 cs.AI
专题命中 视频多模态 :multi-modal(title);分类 cs.CV
专题命中 视频多模态 :multi-modal(title);分类 cs.CV
Journal ref FG2021(long Oral)
专题命中 视频多模态 :multimodal(title);分类 cs.CV
专题命中 视频多模态 :multi-modal(title);分类 cs.CV
Comments Accepted in CVPR 2019 Workshop on Language and Vision (Oral Presentation)
Journal ref CVPR 2019 Workshop on Language and Vision (Oral Presentation)
专题命中 视频多模态 :cross-modal(title);分类 cs.CV
Comments CVPR 2021 (updated references in this version)
专题命中 视频多模态 :multimodal(title);分类 cs.CV
Comments First two authors contributed equally. Code and project website is available here: https://vista.csail.mit.edu