IntCoOp: Interpretability-Aware Vision-Language Prompt Tuning
专题命中 图文多模态 :image-text(abstract);分类 cs.CV、cs.AI
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 图文多模态 :image-text(abstract);分类 cs.CV、cs.AI
专题命中 图文多模态 :image-text(abstract);分类 cs.CV、cs.CL
Comments ALVR Workshop 2024
专题命中 图文多模态 :multi-modal(abstract);分类 cs.CV、cs.CL
专题命中 图文多模态 :image-text(abstract);分类 cs.CV、cs.CL
Comments pixelprose 16M dataset
专题命中 图文多模态 :image-text(abstract);分类 cs.CV、cs.AI
Comments Accepted to CVPR 2024; Earlier version of this paper contained an unintentional error stemming from a bug in the code. This version corrects this error, which had to do with filtering of class names. In consultation with CVPR Program Chairs it was suggested errata be submitted as the updated (fixed) code reinforced original findings (albeit with slightly different final numbers)
专题命中 图文多模态 :image-text(abstract);分类 cs.CV、cs.AI
Comments CVPR 2024 camera ready version
专题命中 图文多模态 :image-text(abstract);分类 cs.CV、cs.AI
Comments 27 pages, 18 figures, 10 tables
专题命中 图文多模态 :multi-modal(abstract);分类 cs.CV、cs.AI
Comments ICML camera-ready version. Code is released at https://github.com/BillChan226/HALC
专题命中 图文多模态 :image-text(abstract);分类 cs.CV、cs.AI
专题命中 图文多模态 :multimodal(abstract);分类 cs.CV、cs.AI
Comments Accepted to the CVPR 2024 Responsible Generative AI (ReGenAI) Workshop
专题命中 图文多模态 :multimodal(abstract);分类 cs.CV、cs.MM
Comments Published in MIPR 2024
专题命中 图文多模态 :multi-modal(abstract);分类 cs.CV、cs.AI
Comments ICML 2024 Oral
专题命中 图文多模态 :multimodal(abstract);分类 cs.CV、cs.CL
Comments 9 pages, 3 figures, 3 tables (21 pages, 4 figures, 15 tables including references and appendices)
专题命中 图文多模态 :multi-modal(abstract);分类 cs.CV、cs.CL
Comments To be published in the findings of the 2024 Annual Meeting of the Association for Computational Linguistics
专题命中 图文多模态 :multimodal(abstract);分类 cs.CV、cs.AI
Comments ACL 2024
专题命中 图文多模态 :multimodal(abstract);分类 cs.CV、cs.AI
Comments Accepted to ICASSP 2024
专题命中 图文多模态 :multimodal(abstract);分类 cs.CV、cs.AI
专题命中 图文多模态 :image-text(abstract);分类 cs.CV、cs.AI
专题命中 图文多模态 :multimodal(abstract);分类 cs.CV、cs.AI
专题命中 图文多模态 :image-text(abstract);分类 cs.CV、cs.AI
Comments 5 pages, 3 figures
专题命中 图文多模态 :multimodal(abstract);分类 cs.CL、cs.AI
Comments Accepted in ICLR 2024
专题命中 图文多模态 :multi-modal(abstract);分类 cs.CV、cs.AI
专题命中 图文多模态 :cross-modal(abstract);分类 cs.CV、cs.AI
专题命中 图文多模态 :multimodal(abstract);分类 cs.CV、cs.CL
Comments To appear in the Proceedings of the Annual Meeting of the Cognitive Science Society 2024
专题命中 图文多模态 :multi-modal(abstract);分类 cs.CV、cs.AI
Comments 9 pages, 3 figures, Accepted at CVPR 2024 Vision and Language for Autonomous Driving and Robotics Workshop
专题命中 图文多模态 :multimodal(abstract);分类 cs.CV、cs.AI
专题命中 图文多模态 :image-text(abstract);分类 cs.CV、cs.AI
Comments ICLR 2024 (spotlight). First two authors contributed equally. Code available at https://github.com/twke18/CAST
专题命中 图文多模态 :multimodal(abstract);分类 cs.CV、cs.MM
Comments 11 pages, 9 figures, 6 tables. For associated code, see https://anonymous.4open.science/r/Explore_FGVDs-E277
专题命中 图文多模态 :multimodal(abstract);分类 cs.CL、cs.AI
Journal ref KBC-LM workshop@ ISWC 2023
专题命中 图文多模态 :image-text(abstract);分类 cs.CV、cs.AI
Comments ICRA 2024