Hyperbolic Image-Text Representations
专题命中 图文多模态 :image-text(title,abstract);multi-modal(abstract);分类 cs.CV
Comments ICML 2023 (v3: Add link to code in abstract)
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 图文多模态 :image-text(title,abstract);multi-modal(abstract);分类 cs.CV
Comments ICML 2023 (v3: Add link to code in abstract)
专题命中 图文多模态 :image-text(title,abstract);cross-modal(abstract);分类 cs.MM
Comments Accepted by ICASSP 2024
专题命中 图文多模态 :cross-modal(title,abstract);image-text(abstract);分类 cs.CV
Comments This paper is accepted by NeurIPS 2023
专题命中 图文多模态 :multi-modal(title,abstract);image-text(abstract);分类 cs.CV
专题命中 图文多模态 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV
Comments Project Page: https://praeclarumjj3.github.io/vcoder/
专题命中 图文多模态 :multi-modal(title,abstract);image-text(abstract);分类 cs.AI
Comments AAAI2024
专题命中 图文多模态 :image-text(title,abstract);multi-modal(abstract);分类 cs.MM
专题命中 图文多模态 :multi-modal(title,abstract);cross-modal(abstract);分类 cs.CV
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV、cs.CL、cs.AI
Comments 25 pages, 25M file size. Project Page: https://llava-vl.github.io/llava-plus/
专题命中 图文多模态 :multimodal(title,abstract);image-text(abstract);分类 cs.CV
Comments Accepted at NeurIPS 2023 Datasets & Benchmarks
专题命中 图文多模态 :multimodal(title,abstract);image-text(abstract);分类 cs.CV
Comments ICCV2023 CLVL Workshop
专题命中 图文多模态 :multimodal(title,abstract);image-text(abstract);分类 cs.CV
专题命中 图文多模态 :image-text(title,abstract);multimodal(abstract);分类 cs.CV
Comments 11 Pages, 5 Figures
专题命中 图文多模态 :multimodal(title,abstract);image-text(abstract);分类 cs.CL
Comments 8 pages, ACL 2023 Finding
专题命中 图文多模态 :image-text(title,abstract);multimodal(abstract);分类 cs.CV
专题命中 图文多模态 :image-text(title,abstract);cross-modal(abstract);分类 cs.CV
Comments Machine Learning for Healthcare Conference 2023
专题命中 图文多模态 :multimodal(title,abstract);image-text(abstract);分类 cs.MM
专题命中 图文多模态 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV
专题命中 图文多模态 :multi-modal(title,abstract);image-text(abstract);分类 cs.CV
Comments CVPR 2023
专题命中 图文多模态 :cross-modal(title,abstract);multimodal(abstract);分类 cs.CV
Comments Accepted at PR
专题命中 图文多模态 :multi-modal(title,abstract);multimodal(abstract);分类 cs.CL
Comments Accepted to ACL 2023 Main Conference
专题命中 图文多模态 :multimodal(title,abstract);image-text(abstract);分类 cs.CV
Comments Accepted at CVPR-2023. Codes/models available at https://github.com/TalalWasim/Vita-CLIP
专题命中 图文多模态 :multi-modal(title,abstract);multimodal(abstract);分类 cs.CV
Comments Accepted at CVPR2023
专题命中 图文多模态 :cross-modal(title,abstract);image-text(abstract);分类 cs.CV
Comments Accepted by CVPR 2023
专题命中 图文多模态 :multimodal(title,abstract);vision-language-audio(abstract);分类 cs.CV
Comments Accepted by AAAI2023
专题命中 图文多模态 :image-text(title,abstract);cross-modal(abstract);分类 cs.CV
Comments Accepted by ICLR 2023
专题命中 图文多模态 :multi-modal(title,abstract);image-text(abstract);分类 cs.CV
Comments AAAI 2023 (Oral presentation paper). Updated version
专题命中 图文多模态 :multimodal(title,abstract);image-text(abstract);分类 cs.CV
专题命中 图文多模态 :image-text(title,abstract);cross-modal(abstract);分类 cs.AI
Comments Accpted by IJCAI'2022 survey track
专题命中 图文多模态 :image-text(title,abstract);cross-modal(abstract);分类 cs.CV
Comments arXiv admin note: text overlap with arXiv:2201.11307
Journal ref WACV2023