Look, Remember and Reason: Grounded reasoning in videos with language models
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV
Comments To appear at ICLR 2024
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV
Comments To appear at ICLR 2024
专题命中 视频多模态 :multi-modal(abstract);分类 cs.AI
专题命中 视频多模态 :image-text(abstract);分类 cs.CV
专题命中 视频多模态 :image-text(abstract);分类 cs.CV
专题命中 视频多模态 :cross-modal(abstract);分类 cs.MM
Comments Accepted by ICASSP 2024
专题命中 视频多模态 :cross-modal(abstract);分类 cs.CV
Comments Correct typos in the caption of Figure 1; Change the project website address. Project page: https://jeanne-wang.github.io/jumpcutsmoothing/
专题命中 视频多模态 :multimodal(abstract);分类 cs.AI
Comments 9 pages, 6 figures, to be published
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV
专题命中 视频多模态 :cross-modal(abstract);分类 cs.CV
Comments ICCV2023 oral, release the code
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV
Comments Accepted by IEEE Transactions on Dependable and Secure Computing (TDSC). Corresponding authors: Zitong Yu and Wenhan Yang
专题命中 视频多模态 :multimodal(abstract);分类 cs.CV
Comments Smart Health Journal
专题命中 视频多模态 :multimodal(abstract);分类 cs.CV
Comments arXiv admin note: text overlap with arXiv:2307.07977
专题命中 视频多模态 :multimodal(abstract);分类 cs.AI
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV
Comments Accepted in NeurIPS 2023
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV
专题命中 视频多模态 :multi-modal(abstract);分类 cs.AI
Comments 25 pages
专题命中 视频多模态 :cross-modal(abstract);分类 cs.CV
Comments accpeted by AAAI 2024
专题命中 视频多模态 :cross-modal(abstract);分类 cs.CV
Comments Accepted to AAAI 2024
专题命中 视频多模态 :multimodal(abstract);分类 cs.CV
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV
Comments accepted by IEEE Transactions on Image Processing
Journal ref IEEE Transactions on Image Processing 2023
专题命中 视频多模态 :cross-modal(abstract);分类 cs.CV
Comments Accepted on AAAI2024
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV
Journal ref Sci Data 10, 859 (2023)
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV
专题命中 视频多模态 :multimodal(abstract);分类 cs.CL
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV
专题命中 视频多模态 :multimodal(abstract);分类 cs.CV
Comments 16 pages, 7 figures
专题命中 视频多模态 :multimodal(abstract);分类 cs.CV
Comments Dataset: https://drive.google.com/drive/folders/1Cpkw_TI1IIxXdzor0pOXG3rWJWuKU5Ex?usp=drive_link
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV
专题命中 视频多模态 :cross-modal(abstract);分类 cs.CV
Comments WACV 2024; Code: https://github.com/sangminwoo/SVOL