jina-clip-v2: Multilingual Multimodal Embeddings for Text and Images
机构 * Jina AI GmbH(Jina AI公司)
专题命中 图文多模态 :multimodal(title,abstract);image-text(abstract);分类 cs.CV、cs.CL
Comments 30 pages, 1-10 main paper, 10-12 refs, 12-30 benchmarks
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
机构 * Jina AI GmbH(Jina AI公司)
专题命中 图文多模态 :multimodal(title,abstract);image-text(abstract);分类 cs.CV、cs.CL
Comments 30 pages, 1-10 main paper, 10-12 refs, 12-30 benchmarks
专题命中 图文多模态 :multimodal(title,abstract);MLLM(abstract);分类 cs.CL、cs.AI
Comments AAAI 2025
专题命中 图文多模态 :multimodal(title,abstract);cross-modal(abstract);分类 cs.CV、cs.CL
专题命中 图文多模态 :multimodal(title,abstract);cross-modal(abstract);分类 cs.CV、cs.CL
专题命中 图文多模态 :multimodal(title,abstract);cross-modal(abstract);分类 cs.CV、cs.AI
Comments 21 pages, 4 figures, In Press by a journal
专题命中 图文多模态 :image-text(title,abstract);multimodal(abstract);分类 cs.CV、cs.AI
专题命中 图文多模态 :multi-modal(title,abstract);image-text(abstract);分类 cs.CL、cs.AI
Comments 9 pages, 4 figures, 5 tables
专题命中 图文多模态 :multi-modal(title,abstract);image-text(abstract);分类 cs.CV、cs.AI
专题命中 图文多模态 :multimodal(title);multi-modal(abstract);MLLM(abstract);分类 cs.CL、cs.AI
专题命中 图文多模态 :multi-modal(title);cross-modal(abstract);image-text(abstract);分类 cs.CV、cs.AI
专题命中 图文多模态 :multimodal(title,abstract);cross-modal(abstract);分类 cs.CL、cs.AI
Comments 14 pages
专题命中 图文多模态 :multimodal(title,abstract);cross-modal(abstract);分类 cs.CV、cs.AI
专题命中 图文多模态 :multimodal(title,abstract);image-text(abstract);分类 cs.CL、cs.MM
专题命中 图文多模态 :multimodal(title,abstract);image-text(abstract);分类 cs.CV、cs.CL
专题命中 图文多模态 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV、cs.CL
Comments A manuscript that should have been Arxived in May :)
专题命中 图文多模态 :multimodal(title,abstract);image-text(abstract);分类 cs.CL、cs.AI
Comments 10 pages, 6 figures
专题命中 图文多模态 :multimodal(title,abstract);image-text(abstract);分类 cs.CV、cs.AI
Comments Accepted to 2024 IEEE International Conference on Image Processing (ICIP) as oral presentation
专题命中 图文多模态 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV、cs.CL
专题命中 图文多模态 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV、cs.AI
Comments Accepted by ECCV 2024
专题命中 图文多模态 :multimodal(title,abstract);cross-modal(abstract);分类 cs.CV、cs.AI
专题命中 图文多模态 :multimodal(title,abstract);image-text(abstract);分类 cs.CV、cs.CL
Comments In ACL-Findings 2024
专题命中 图文多模态 :multimodal(title,abstract);image-text(abstract);分类 cs.CV、cs.MM
专题命中 图文多模态 :multimodal(title,abstract);image-text(abstract);分类 cs.CV、cs.CL
Comments Preprint. 33 pages, 17 Figures, 3 Tables
专题命中 图文多模态 :image-text(title);multimodal(abstract);multimodal foundation model(abstract);分类 cs.CV、cs.CL
Comments Accepted to ECCV 2024. Project page: https://hierarcaps.github.io/
专题命中 图文多模态 :multimodal(title,abstract);image-text(abstract);分类 cs.CV、cs.AI
专题命中 图文多模态 :multimodal(title,abstract);image-text(abstract);分类 cs.CV、cs.MM
Comments This work won first place in CVPR 2024 Workshop Challenge: Black-box Adversarial Attacks on Vision Foundation Models
专题命中 图文多模态 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV、cs.CL
Comments Accepted by ICML workshop 2024
专题命中 图文多模态 :multimodal(title,abstract);image-text(abstract);分类 cs.CL、cs.AI
Comments Findings of ACL 2024
专题命中 图文多模态 :multimodal(title,abstract);image-text(abstract);分类 cs.CV、cs.CL
Comments Accepted to Findings of ACL 2024
专题命中 图文多模态 :cross-modal(title,abstract);image-text(abstract);分类 cs.CV、cs.AI