Q-Boost: On Visual Quality Assessment Ability of Low-level Multi-Modality Foundation Models
专题命中 视觉问答 :MLLM(abstract);分类 cs.CV
AI 大模型
视觉语言模型、视觉推理、视觉问答、图文理解和视觉 grounding。
专题命中 视觉问答 :MLLM(abstract);分类 cs.CV
专题命中 视觉问答 :visual question answering(abstract);分类 cs.CV
Comments 22pages
专题命中 视觉问答 :visual question answering(abstract);分类 cs.CV
Comments already be accepted by 2024 3rd International Conference on Computer, Artificial Intelligence and Control Engineering (CAICE 2024)
专题命中 视觉问答 :visual question answering(abstract);分类 cs.CV
Comments In Proceedings of The 38th Annual AAAI Conference on Artificial Intelligence
专题命中 视觉问答 :vision-language model(abstract);分类 cs.AI
Comments Accepted as main paper in EMNLP 2023
专题命中 视觉问答 :visual question answering(abstract);分类 cs.CV
专题命中 视觉问答 :multimodal large language model(abstract);分类 cs.CV
专题命中 视觉问答 :visual question answering(abstract);分类 cs.AI
专题命中 视觉问答 :vision-language model(abstract);分类 cs.CV
Comments 4th I Can't Believe It's Not Better Workshop (co-located with NeurIPS 2023)
专题命中 视觉问答 :visual question answering(abstract);分类 cs.CV
Comments arXiv admin note: substantial text overlap with arXiv:2211.13437
专题命中 视觉问答 :visual question answering(abstract);分类 cs.CV
专题命中 视觉问答 :visual question answering(abstract);分类 cs.CV
专题命中 视觉问答 :visual question answering(abstract);分类 cs.CV
Comments 13 pages,8 figures
专题命中 视觉问答 :visual question answering(abstract);分类 cs.AI
专题命中 视觉问答 :visual question answering(abstract);分类 cs.AI
Comments This paper is the technical research paper of CIKM 2023 DocIU challenges. The authors received the CIKM 2023 DocIU Winner Award, sponsored by Google, Microsoft, and the Centre for data-driven geoscience
专题命中 视觉问答 :visual question answering(abstract);分类 cs.CV
Comments This paper has been accepted by the Journal of Biomedical Informatics
Journal ref Journal of Biomedical Informatics, Volume 146, October 2023, 104482
专题命中 视觉问答 :visual question answering(abstract);分类 cs.CV
Comments Accepted by TIP 2023
专题命中 视觉问答 :visual question answering(abstract);分类 cs.AI
专题命中 视觉问答 :visual question answering(abstract);分类 cs.CV
Comments To appear in Vision-and-Language Algorithmic Reasoning Workshop at ICCV 2023
专题命中 视觉问答 :vision-language model(abstract);分类 cs.CV
Comments ICCV2023 CLVL Workshop (Oral). Project page: https://engindeniz.github.io/vitis
专题命中 视觉问答 :visual question answering(abstract);分类 cs.CV
专题命中 视觉问答 :visual language model(abstract);分类 cs.CV
Comments Accepted at ICCVW 2023
专题命中 视觉问答 :visual question answering(abstract);分类 cs.CV
专题命中 视觉问答 :visual question answering(abstract);分类 cs.CV
专题命中 视觉问答 :visual question answering(abstract);分类 cs.CV
Comments website (https://prior.allenai.org/projects/close), code (https://github.com/allenai/close)
专题命中 视觉问答 :visual question answering(abstract);分类 cs.CV
Comments Accepted to ICCV 2023
专题命中 视觉问答 :visual question answering(abstract);分类 cs.CV
Comments Accepted to ICCV 2023
专题命中 视觉问答 :visual question answering(abstract);分类 cs.CV
Comments Accepted to ICCV 2023
专题命中 视觉问答 :visual question answering(abstract);分类 cs.CV
Comments Published as conference paper at ICCV 2023. 13 pages, 6 figures, 7 tables
专题命中 视觉问答 :visual question answering(abstract);分类 cs.CV
Comments ICCV'23