TWIST & SCOUT: Grounding Multimodal LLM-Experts by Forget-Free Tuning
专题命中 图文多模态 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 图文多模态 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV
专题命中 图文多模态 :multi-modal(title,abstract);MLLM(abstract);分类 cs.CV
专题命中 图文多模态 :multi-modal(title,abstract);cross-modal(abstract);分类 cs.CV
专题命中 图文多模态 :multimodal(title,abstract);cross-modal(abstract);分类 cs.CV
Comments Accepted by AAAI 2025
专题命中 图文多模态 :multimodal(title,abstract);image-text(abstract);分类 cs.CV
Comments 8 pages, 8 Figures, 3 Tables
Journal ref Pattern Recognition Letters, Special Issues, 2024
专题命中 图文多模态 :multimodal(title,abstract);image-text(abstract);分类 cs.CV
Comments CVPR 2025
专题命中 图文多模态 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV
Comments ICLR-2025. The project page: https://chocowu.github.io/SeTok-web/
专题命中 图文多模态 :multi-modal(title);multimodal(abstract);multimodal foundation model(abstract);分类 cs.AI
Comments 30 pages, 4 Figures, 10 Tables
专题命中 图文多模态 :multi-modal(title,abstract);image-text(abstract);分类 cs.CV
Comments ICLR 2025 Poster
专题命中 图文多模态 :multimodal(title,abstract);multimodal foundation model(abstract);分类 cs.CV
专题命中 图文多模态 :multimodal(title,abstract);image-text(abstract);分类 cs.AI
专题命中 图文多模态 :multi-modal(title,abstract);image-text(abstract);分类 cs.CV
Comments USENIX Security 2025
专题命中 图文多模态 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV
Comments Accepted to AAAI2025(Oral)
专题命中 图文多模态 :image-text(title,abstract);multimodal(abstract);分类 cs.CV
Comments AAAI 2025
专题命中 图文多模态 :multimodal(title);multi-modal(abstract);MLLM(abstract);分类 cs.CL
Comments preprint
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV、cs.CL、cs.AI
Comments Accepted by TKDE
专题命中 图文多模态 :multimodal(title,abstract);image-text(abstract);分类 cs.CL
专题命中 图文多模态 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV
Comments 44 pages
专题命中 图文多模态 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV
Comments 6 pages, 3 figures, under review
专题命中 图文多模态 :multimodal(title,abstract);MLLM(abstract);分类 cs.CL
专题命中 图文多模态 :multi-modal(title,abstract);MLLM(abstract);分类 cs.CV
Comments 5 pages, Accepted by ICASSP2025, full paper
专题命中 图文多模态 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV
Comments 16 pages, 10 figures, accepted by AAAI 25
专题命中 图文多模态 :cross-modal(title,abstract);image-text(abstract);分类 cs.CV
专题命中 图文多模态 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV
专题命中 图文多模态 :image-text(title,abstract);multi-modal(abstract);分类 cs.CV
Comments Code, models and demo available at https://github.com/mbzuai-oryx/UniMed-CLIP
专题命中 图文多模态 :multimodal(title,abstract);image-text(abstract);分类 cs.CV
Comments The code and models will be available at https://github.com/OpenGVLab/V2PE
专题命中 图文多模态 :multimodal(title,abstract);image-text(abstract);分类 cs.CV
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV、cs.CL、cs.AI
Comments ECCV 2024 Workshop on Green Foundation Models
专题命中 图文多模态 :multi-modal(title,abstract);MLLM(abstract);分类 cs.CV
Comments 13 pages; with PosterGen as extension; IEEE template
专题命中 图文多模态 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV