GazeCLIP: Enhancing Gaze Estimation Through Text-Guided Multimodal Learning
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV
Comments Accepted in CVPR 2025. Code is available at https://github.com/callsys/DynRefer
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV
专题命中 图文多模态 :multimodal(title);multi-modal(abstract);分类 cs.CV
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CL
专题命中 图文多模态 :image-text(title);multimodal(abstract);分类 cs.CV
Comments Accepted to the 2025 Annual Conference of the Nations of the Americas Chapter of the Association for Computational Linguistics (NAACL 2025). The first two authors contributed equally and were listed in random order
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CL
Comments Preprint. Accepted at ICWSM'25
专题命中 图文多模态 :multi-modal(title,abstract);分类 cs.CV
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CL
Comments Accepted to NAACL 2025 Main (Camera-Ready Version)
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.MM
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CL
Comments under review
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.AI
专题命中 图文多模态 :cross-modal(title,abstract);分类 cs.CV
Comments Accepted by ICASSP 2025
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CL
专题命中 图文多模态 :multi-modal(title,abstract);分类 cs.CV
Comments Code is available at https://github.com/Row11n/Prova/tree/main
专题命中 图文多模态 :image-text(title,abstract);分类 cs.CV
专题命中 图文多模态 :cross-modal(title,abstract);分类 cs.CV
Comments Accepted to WACV 2025
专题命中 图文多模态 :multi-modal(title);multimodal(abstract);分类 cs.CV
Comments 4 pages, 2 figures, submitted to IEEE Signal Processing Letters
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV
Comments Accepted at Medical Image Understanding and Analysis (MIUA) 2020
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV
Comments https://github.com/apple/ml-aim
专题命中 图文多模态 :image-text(title);multi-modal(abstract);分类 cs.CV
Comments IEEE VCIP 2024 poster
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV
Comments 17 pages, 13 figures
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV
Comments Technical report
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV
专题命中 图文多模态 :image-text(title,abstract);分类 cs.AI
Comments Project Page: https://source.plus/pd12m
专题命中 图文多模态 :multi-modal(title,abstract);分类 cs.CV
Comments This work has been submitted to the IEEE for possible publication. Camera-ready version and supplementary material
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV
Comments This work has been submitted to the IEEE for possible publication. Codes and data will be later released at https://github.com/jefferyZhan/Griffon