Mutual Information Analysis in Multimodal Learning Systems
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV
Comments 6 pages, 7 figures, IEEE MIPR 2024
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV
Comments 6 pages, 7 figures, IEEE MIPR 2024
专题命中 图文多模态 :image-text(title,abstract);分类 cs.CV
专题命中 图文多模态 :image-text(title,abstract);分类 cs.CV
专题命中 图文多模态 :multimodal(title);multi-modal(abstract);分类 cs.CV
Comments ICLR 2024 Workshop on Reliable and Responsible Foundation Models
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV
专题命中 图文多模态 :image-text(title,abstract);分类 cs.CV
Comments 11 pages, 3 figures
专题命中 图文多模态 :cross-modal(title);image-text(abstract);分类 cs.CV
专题命中 图文多模态 :multi-modal(title,abstract);分类 cs.CV
Comments Accepted by CVPR 2024. Project page: https://github.com/Alexander-Yao/Multi-MaP
专题命中 图文多模态 :multi-modal(title,abstract);分类 cs.CV
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV
专题命中 图文多模态 :multi-modal(title,abstract);分类 cs.CV
专题命中 图文多模态 :cross-modal(title,abstract);分类 cs.CV
Journal ref Multimedia Tools and Applications, Volume 83, pages 12209-12233, 2024
专题命中 图文多模态 :image-text(title,abstract);分类 cs.CV
Comments Accepted to CVPR2024
专题命中 图文多模态 :multimodal(title);cross-modal(abstract);分类 cs.CL
Comments 9 Pages, 3 Figures
专题命中 图文多模态 :image-text(title,abstract);分类 cs.CV
Comments CVPR 2024
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV
Comments Our code is publicly available at https://github.com/bronyayang/HallE_Control
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV
Comments 13 pages, 8 figures, 9 tables
专题命中 图文多模态 :multi-modal(title,abstract);分类 cs.CV
Comments 9 pages, submitted to SIGKDD
专题命中 图文多模态 :multi-modal(title,abstract);分类 cs.CV
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV
Comments 17 pages, 5 figures, and 1 table. arXiv admin note: substantial text overlap with arXiv:2311.10125
专题命中 图文多模态 :multi-modal(title,abstract);分类 cs.CV
Comments We find that the statistical information in Figure 2 neglect the statistics for tSOS, so we make corrections. Additionally, we change the statistical samples to those where CLIP misidentify, but prompt tuning identify correctly. At the same time, we also revise some of the descriptions. The changes to the supplementary materials will be updated shortly. arXiv admin note: text overlap with arXiv:2307.06948 by other authors
专题命中 图文多模态 :cross-modal(title,abstract);分类 cs.CV
Comments Accepted by TIP
专题命中 图文多模态 :multimodal(title);image-text(abstract);分类 cs.CV
专题命中 图文多模态 :multi-modal(title,abstract);分类 cs.CV
专题命中 图文多模态 :multi-modal(title,abstract);分类 cs.CV
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CL
Comments Under Review
专题命中 图文多模态 :cross-modal(title,abstract);分类 cs.CV
Comments Accepted to LREC-COLING 2024
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV
Comments 13 pages
专题命中 图文多模态 :image-text(title,abstract);分类 cs.CV
专题命中 图文多模态 :multimodal(title);cross-modal(abstract);分类 cs.CL
Comments Accepted at ACL2023 Findings