Vintern-1B: An Efficient Multimodal Large Language Model for Vietnamese
专题命中 视觉问答 :multimodal large language model(title,abstract);MLLM(abstract);分类 cs.LG
AI 大模型
视觉语言模型、视觉推理、视觉问答、图文理解和视觉 grounding。
专题命中 视觉问答 :multimodal large language model(title,abstract);MLLM(abstract);分类 cs.LG
专题命中 视觉问答 :visual question answering(title,abstract);vision-language model(abstract);分类 cs.CV
专题命中 视觉问答 :vision-language model(title,abstract);visual question answering(abstract);分类 cs.CV
专题命中 视觉问答 :visual question answering(title,abstract);multimodal large language model(abstract);分类 cs.CV
Comments Accepted at the MICCAI AMAI Workshop 2024
专题命中 视觉问答 :visual question answering(title,abstract);multimodal large language model(abstract);分类 cs.CV
专题命中 视觉问答 :visual question answering(title,abstract);visual language model(abstract);分类 cs.AI
专题命中 视觉问答 :visual question answering(title,abstract);vision language model(abstract);分类 cs.AI
Comments 17 pages, 10 images, Accepted at LREC-COLING 2024 - The 2024 Joint International Conference on Computational Linguistics, Language Resources and Evaluation
专题命中 视觉问答 :visual question answering(title,abstract);visual language model(abstract);分类 cs.CV
专题命中 视觉问答 :vision-language model(title,abstract);visual question answering(abstract);分类 cs.CV
Comments To appear at EACL 2024
专题命中 视觉问答 :visual question answering(title,abstract);LLaVA(abstract);分类 cs.CV
专题命中 视觉问答 :vision-language model(title,abstract);visual question answering(abstract);分类 cs.CV
Comments Accepted by AAAI24. The first two authors contributed equally to this paper
专题命中 视觉问答 :VLM(title,abstract);vision-language model(abstract);分类 cs.CV
Comments Project page: https://kfirgoldberg.github.io/ConceptLab/
专题命中 视觉问答 :vision-language model(title,abstract);visual question answering(abstract);分类 cs.CV
Comments Submitted to IEEE ISBI 2024. Under review
专题命中 视觉问答 :grounding(title,abstract);visual question answering(abstract);分类 cs.CV
专题命中 视觉问答 :visual question answering(title,abstract);visual reasoning(abstract);分类 cs.CV
Comments 8 pages, 7 figures, Accepted to DICTA 2023 Conference
专题命中 视觉问答 :visual question answering(title,abstract);grounding(abstract);分类 cs.CV
专题命中 视觉问答 :grounding(title,abstract);visual question answering(abstract);分类 cs.CV
Comments IEEE/CVF International Conference on Computer Vision
专题命中 视觉问答 :vision-language model(title,abstract);visual question answering(abstract);分类 cs.CV
Comments Camera-ready for 23, ACM MM
专题命中 视觉问答 :visual question answering(title,abstract);vision-language model(abstract);分类 cs.CV
Comments 13 pages, 6 figures, 9 tables. Accepted to CVPR 2023
专题命中 视觉问答 :vision-language model(title,abstract);visual question answering(abstract);分类 cs.CV
Comments Findings of the Association for Computational Linguistics: NAACL 2022, pages 1031-1041, Seattle, United States. Association for Computational Linguistics
专题命中 视觉问答 :visual question answering(title,abstract);vision language model(abstract);分类 cs.CV
Comments 20 pages, 6 figures, 13 tables
专题命中 视觉问答 :visual language model(title,abstract);visual question answering(abstract);分类 cs.CV
Comments Tech Report
专题命中 视觉问答 :visual question answering(title,abstract);visual reasoning(abstract);分类 cs.CV
专题命中 视觉问答 :visual question answering(title,abstract);grounding(abstract);分类 cs.CV
Comments Accepted to EMNLP 2021
专题命中 视觉问答 :vision-language model(title);visual question answering(abstract);grounding(abstract);分类 cs.CV
Comments ECCV 2022 (Oral Presentation)
专题命中 视觉问答 :grounding(title,abstract);visual question answering(abstract);分类 cs.CV
Comments To appear at ECCV 2022
专题命中 视觉问答 :visual question answering(title,abstract);visual reasoning(abstract);分类 cs.CV
专题命中 视觉问答 :vision-language model(title,abstract);visual question answering(abstract);分类 cs.CV
Comments Accepted at ICPR 2022; 9 pages
专题命中 视觉问答 :visual question answering(title,abstract);vision-language model(abstract);分类 cs.CV
专题命中 视觉问答 :visual question answering(title);visual reasoning(abstract);grounding(abstract);分类 cs.CV
Comments Preprint, 10 pages