SP3D: Boosting Sparsely-Supervised 3D Object Detection via Accurate Cross-Modal Semantic Prompts
专题命中 多模态生成 :cross-modal(title,abstract);multimodal(abstract);分类 cs.CV
Comments 11 pages, 3 figures
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 多模态生成 :cross-modal(title,abstract);multimodal(abstract);分类 cs.CV
Comments 11 pages, 3 figures
专题命中 多模态生成 :multimodal(title,abstract);multi-modal(abstract);分类 cs.CV
专题命中 多模态生成 :multimodal(title,abstract);multimodal foundation model(abstract);分类 cs.CV
Comments We added benchmark results (without updating models) and ablation study in this version. Project released at: https://github.com/AILab-CVC/SEED-X
专题命中 多模态生成 :multi-modal(title,abstract);cross-modal(abstract);分类 cs.CV
专题命中 多模态生成 :multimodal(title,abstract);any-to-any(abstract);分类 cs.CV
专题命中 多模态生成 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV
专题命中 多模态生成 :multimodal(title,abstract);MLLM(abstract);分类 cs.CL
Comments Work in progress
专题命中 多模态生成 :multimodal(title,abstract);MLLM(abstract);分类 cs.AI
专题命中 多模态生成 :cross-modal(title,abstract);multimodal(abstract);分类 cs.CV
专题命中 多模态生成 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV
Comments Tech report
专题命中 多模态生成 :multi-modal(title,abstract);MLLM(abstract);分类 cs.AI
Comments 13 pages, 7 figures
专题命中 多模态生成 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV
Comments Accepted by ACCV-2025, Our source code is available at: https://github.com/ucasyjz/VIP, 15 pages
专题命中 多模态生成 :multimodal(title);MLLM(abstract);cross-modal(abstract);分类 cs.CV
专题命中 多模态生成 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV
Comments Accepted by NeurIPS 2024 (Spotlight)
专题命中 多模态生成 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV
Comments NeurIPS 2024 Spotlight
专题命中 多模态生成 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV
Comments ACM MM 2024, Oral
专题命中 多模态生成 :cross-modal(title,abstract);multimodal(abstract);分类 cs.CV
专题命中 多模态生成 :multimodal(title,abstract);cross-modal(abstract);分类 cs.AI
Comments 22 pages, 12 figures
专题命中 多模态生成 :multi-modal(title,abstract);multimodal(abstract);分类 cs.CV
专题命中 多模态生成 :multi-modal(title,abstract);分类 cs.CV、cs.CL、cs.AI
Comments 11 pages, 7 figures
专题命中 多模态生成 :multi-modal(title,abstract);cross-modal(abstract);分类 cs.CV
Comments Accepted by ACM MM 2024
专题命中 多模态生成 :multi-modal(title,abstract);multimodal(abstract);分类 cs.CV
Comments Published as a conference paper at ICLR 2024
专题命中 多模态生成 :cross-modal(title,abstract);multi-modal(abstract);分类 cs.CV
专题命中 多模态生成 :multimodal(title,abstract);cross-modal(abstract);分类 cs.CV
专题命中 多模态生成 :multi-modal(title,abstract);multimodal(abstract);分类 cs.CL
Comments 26 pages, 5 figures
专题命中 多模态生成 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV
Comments The paper is accepted by ECCV2024. The code is available at https://github.com/dvlab-research/LLMGA
专题命中 多模态生成 :cross-modal(title,abstract);multimodal(abstract);分类 cs.CV
Comments 19 pages, 7 figures; including supplementary material
专题命中 多模态生成 :multimodal(title,abstract);cross-modal(abstract);分类 cs.AI
专题命中 多模态生成 :multi-modal(title,abstract);cross-modal(abstract);分类 cs.CV
Comments This is the preprint version of the paper and supplemental material to appear in ECCV 2024. Please cite the final published version. Code is available at https://github.com/HenryCilence/Broker-Modality-Crowd-Counting
专题命中 多模态生成 :multimodal(title,abstract);multi-modal(abstract);分类 cs.CV