IDMR: Towards Instance-Driven Precise Visual Correspondence in Multimodal Retrieval
专题命中 跨模态检索 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV、cs.AI
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 跨模态检索 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV、cs.AI
专题命中 跨模态检索 :multi-modal(title,abstract);cross-modal(abstract);分类 cs.CV、cs.AI
Journal ref CVPR2025
专题命中 跨模态检索 :multimodal(title,abstract);cross-modal(abstract);分类 cs.CV、cs.AI
Journal ref Published at ICLR 2025
专题命中 跨模态检索 :multimodal(title,abstract);cross-modal(abstract);分类 cs.CV、cs.CL
专题命中 跨模态检索 :cross-modal(title,abstract);multimodal(abstract);分类 cs.CL、cs.AI
专题命中 跨模态检索 :multimodal(title,abstract);cross-modal(abstract);分类 cs.CV、cs.AI
专题命中 跨模态检索 :cross-modal(title,abstract);audio-visual(abstract);分类 cs.CV、cs.MM
Comments Accepted as full paper at ECIR 2025
专题命中 跨模态检索 :cross-modal(title,abstract);multimodal(abstract);分类 cs.CV、cs.MM
专题命中 跨模态检索 :multimodal(title,abstract);multi-modal(abstract);分类 cs.CL、cs.AI
Comments arXiv admin note: text overlap with arXiv:2010.03604 by other authors
专题命中 跨模态检索 :multimodal(title,abstract);cross-modal(abstract);分类 cs.CV、cs.AI
专题命中 跨模态检索 :cross-modal(title,abstract);multi-modal(abstract);分类 cs.CV、cs.MM
Comments 9 pages, AAAI 25 conference
专题命中 跨模态检索 :image-text(title,abstract);multimodal(abstract);分类 cs.CV、cs.CL
专题命中 跨模态检索 :cross-modal(title,abstract);image-text(abstract);分类 cs.CV、cs.CL
Comments Accepted by the 39th AAAI Conference on Artificial Intelligence (AAAI-25)
专题命中 跨模态检索 :multimodal(title,abstract);cross-modal(abstract);分类 cs.CV、cs.AI
Comments Accepted at KDD'25
专题命中 跨模态检索 :multimodal(title,abstract);cross-modal(abstract);分类 cs.CV、cs.AI
Comments The code is accessible at https://github.com/mahmoodlab/TITAN
专题命中 跨模态检索 :cross-modal(title,abstract);multimodal(abstract);分类 cs.CV、cs.CL
专题命中 跨模态检索 :multimodal(title,abstract);cross-modal(abstract);分类 cs.CV、cs.MM
专题命中 跨模态检索 :multimodal(title,abstract);MLLM(abstract);分类 cs.CL、cs.AI
专题命中 跨模态检索 :multi-modal(title,abstract);multimodal(abstract);分类 cs.CV、cs.AI
Comments 10 pages, 5 figures, 9 tables. Supplementary detail in Appendix. Code made available in Github for reproducibility
专题命中 跨模态检索 :cross-modal(title,abstract);image-text(abstract);分类 cs.CV、cs.MM
Journal ref IEEE Transactions on Image Processing, vol. 33, pp. 2558-2571, 2024
专题命中 跨模态检索 :multimodal(title,abstract);cross-modal(abstract);分类 cs.CV、cs.AI
Comments The 26th International Conference on Artificial Intelligence (ICAI'24)
专题命中 跨模态检索 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV、cs.AI
Comments 8 pages, 1 figure
专题命中 跨模态检索 :multimodal(title,abstract);multimodal foundation model(abstract);分类 cs.CV、cs.CL
专题命中 跨模态检索 :multi-modal(title,abstract);image-text(abstract);分类 cs.CV、cs.MM
Comments 16 pages, 12 figures
专题命中 跨模态检索 :multimodal(title,abstract);cross-modal(abstract);分类 cs.CL、cs.MM
Comments Accepted by SIGIR 2024
专题命中 跨模态检索 :cross-modal(title,abstract);image-text(abstract);分类 cs.AI、cs.MM
Comments Accepted by KDD 2024 Research Track
专题命中 跨模态检索 :multimodal(title,abstract);image-text(abstract);分类 cs.CV、cs.CL
专题命中 跨模态检索 :multi-modal(title,abstract);image-text(abstract);分类 cs.CV、cs.CL
Comments Accepted to ACL 2024 main conference
专题命中 跨模态检索 :multi-modal(title,abstract);MLLM(abstract);分类 cs.CV、cs.AI
Comments Submitted at BMVC 2024
专题命中 跨模态检索 :multimodal(title,abstract);cross-modal(abstract);分类 cs.CL、cs.MM
Comments 11 pages, 6 figures, 3 tables