Self-Supervised Visual Representations for Cross-Modal Retrieval
专题命中 跨模态检索 :cross-modal(title,abstract);分类 cs.CV
Comments arXiv admin note: text overlap with arXiv:1807.02110
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 跨模态检索 :cross-modal(title,abstract);分类 cs.CV
Comments arXiv admin note: text overlap with arXiv:1807.02110
专题命中 跨模态检索 :multi-modal(title,abstract);分类 cs.CV
Comments 10 pages including reference, 8 figures. First two authors are equal contributors
专题命中 跨模态检索 :multi-modal(title,abstract);分类 cs.CV
专题命中 跨模态检索 :cross-modal(title,abstract);分类 cs.CV
Comments To appeared on IEEE Trans. Image Processing. arXiv admin note: text overlap with arXiv:1703.10593 by other authors
专题命中 跨模态检索 :multimodal(title,abstract);分类 cs.CL
Comments Proceedings of the 22nd Conference on Computational Natural Language Learning (CoNLL 2018), pages 260-270. Brussels, Belgium, October 31 - November 1, 2018. Association for Computational Linguistics
Journal ref Proceedings of the 22nd Conference on Computational Natural Language Learning (CoNLL 2018), pages 260-270. Brussels, Belgium, October 31 - November 1, 2018. Association for Computational Linguistics
专题命中 跨模态检索 :multi-modal(title,abstract);分类 cs.CV
专题命中 跨模态检索 :multimodal(title,abstract);分类 cs.CL
专题命中 跨模态检索 :multi-modal(title,abstract);分类 cs.MM
Comments 6 pages
专题命中 跨模态检索 :cross-modal(title,abstract);分类 cs.MM
Comments 27 pages
专题命中 跨模态检索 :cross-modal(title,abstract);分类 cs.CV
Comments To appear in ECCV 2018
专题命中 跨模态检索 :multimodal(title,abstract);分类 cs.CV
专题命中 跨模态检索 :cross-modal(title,abstract);分类 cs.CV
Comments Accepted at ICPR 2018
专题命中 跨模态检索 :cross-modal(title,abstract);分类 cs.CV
专题命中 跨模态检索 :cross-modal(title,abstract);分类 cs.CV
Comments 12 pages, submitted to IEEE Transactions on Cybernetics
专题命中 跨模态检索 :cross-modal(title,abstract);分类 cs.CV
Comments 9 pages, 8 figures
专题命中 跨模态检索 :cross-modal(title,abstract);分类 cs.CV
Comments 8 pages, accepted by 32th AAAI Conference on Artificial Intelligence (AAAI), 2018
专题命中 跨模态检索 :cross-modal(title,abstract);分类 cs.CV
专题命中 跨模态检索 :multi-modal(title,abstract);分类 cs.CV
专题命中 跨模态检索 :cross-modal(title,abstract);分类 cs.CV
Comments Revision: Added reference [7] 6 pages, 1 figure, to appear in the proceedings of the IEEE International Conference on Multimedia and Expo (ICME), Jul 10, 2017 - Jul 14, 2017, Hong Kong, Hong Kong
专题命中 跨模态检索 :multi-modal(title,abstract);分类 cs.CV
Comments CVPR 2017
专题命中 跨模态检索 :multi-modal(title,abstract);分类 cs.CL
Comments 4 pages (5 including references), no figures
专题命中 跨模态检索 :cross-modal(title,abstract);分类 cs.CV
Comments Conference paper at CVPR 2016
专题命中 跨模态检索 :multi-modal(title,abstract);分类 cs.CL
专题命中 跨模态检索 :multimodal(title,abstract);分类 cs.AI
Comments Journal Version
专题命中 跨模态检索 :multimodal(title,abstract);分类 cs.CV
Comments 24 pages, 10 figures. A version has been accepted by TPAMI on Aug 4th, 2015. Add footnote about how to train the model in practice in Section 5.1. arXiv admin note: substantial text overlap with arXiv:1305.5306
专题命中 跨模态检索 :multimodal(title,abstract);分类 cs.CV
Comments 9 pages, 6 figures
专题命中 跨模态检索 :multimodal(title,abstract);分类 cs.CV
专题命中 跨模态检索 :multimodal(title,abstract);分类 cs.AI
Comments ii + 22 pages
UniCVR:从对齐到重排序的统一零样本复合视觉检索
机构 * Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)) ; City University of Hong Kong(香港城市大学) ; Southern University of Science and Technology(南方科技大学) ; Pengcheng Laboratory(鹏城实验室)
专题命中 跨模态检索 :MLLM(abstract,abstract_cn);multimodal(abstract);分类 cs.CV、cs.MM
AI总结 UniCVR提出首个统一零样本复合视觉检索框架,结合多模态大语言模型与视觉语言预训练模型,通过两阶段方法实现多任务联合优化,实验表明其在五个基准测试中表现优异。
Xray-Visual模型:在产业级数据上扩展视觉模型
机构 * Meta-AI ; MIT(麻省理工学院) ; University of Maryland(马里兰大学)
专题命中 跨模态检索 :multimodal(abstract);cross-modal(abstract);image-text(abstract);分类 cs.CV、cs.AI
AI总结 Xray-Visual通过三阶段训练流程和LLM2CLIP技术,在产业级数据上实现高效多模态视觉模型,取得最佳性能并提升鲁棒性与泛化能力。