Measuring and Mitigating Hallucinations in Vision-Language Dataset Generation for Remote Sensing
专题命中 图文多模态 :multimodal(abstract);image-text(abstract);分类 cs.CV
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 图文多模态 :multimodal(abstract);image-text(abstract);分类 cs.CV
专题命中 图文多模态 :multimodal(abstract);image-text(abstract);分类 cs.CV
Comments AAAI(Oral)
专题命中 图文多模态 :multimodal(abstract);cross-modal(abstract);分类 cs.CV
Comments Accepted by AAAI2025
专题命中 图文多模态 :multimodal(abstract);MLLM(abstract);分类 cs.CV
专题命中 图文多模态 :multi-modal(abstract);cross-modal(abstract);分类 cs.CV
Comments Accepted by TPAMI
专题命中 图文多模态 :multi-modal(abstract);image-text(abstract);分类 cs.AI
Comments 14 pages, 8 figures, AAAI 2025
Journal ref AAAI 2025
专题命中 图文多模态 :multimodal(abstract);image-text(abstract);分类 cs.CV
Journal ref Proceedings of the 30th ACM SIGKDD Conference on Knowledge Discovery and Data Mining, 2024
专题命中 图文多模态 :multimodal(abstract);cross-modal(abstract);分类 cs.CV
专题命中 图文多模态 :multimodal(abstract);分类 cs.CV、cs.CL、cs.AI
Comments 18pages, Accepted at COLING25
专题命中 图文多模态 :multimodal(abstract);image-text(abstract);分类 cs.CV
Comments Published in WACV 2025 conference
专题命中 图文多模态 :multi-modal(abstract);cross-modal(abstract);分类 cs.CV
Comments Project website is accessible at https://sites.google.com/view/zerokey
专题命中 图文多模态 :multimodal(abstract);image-text(abstract);分类 cs.CV
Comments Accepted by WACV 2025
专题命中 图文多模态 :multi-modal(abstract);MLLM(abstract);分类 cs.CV
Comments Accepted at WACV 2025
专题命中 图文多模态 :multimodal(abstract);cross-modal(abstract);分类 cs.CV
Comments Preprint
专题命中 图文多模态 :multimodal(abstract);image-text(abstract);分类 cs.CV
专题命中 图文多模态 :cross-modal(abstract);image-text(abstract);分类 cs.CV
Comments Accepted at ACM SIGSPATIAL 2024 - Research Papers
专题命中 图文多模态 :multimodal(abstract);image-text(abstract);分类 cs.CV
Comments Accepted by IEEE Transactions on Geoscience and Remote Sensing
专题命中 图文多模态 :cross-modal(abstract);image-text(abstract);分类 cs.CV
Comments Accepted by NeurIPS 2024. The project page: https://github.com/linhuixiao/OneRef
专题命中 图文多模态 :multimodal(abstract);image-text(abstract);分类 cs.CV
Comments 11 pages
专题命中 图文多模态 :cross-modal(abstract);image-text(abstract);分类 cs.CV
Comments Accepted by ACM TOMM
专题命中 图文多模态 :multimodal(abstract);cross-modal(abstract);分类 cs.CV
Comments 21 pages, 15 figures
专题命中 图文多模态 :multimodal(abstract);multi-modal(abstract);分类 cs.CV
Comments Accepted by NeurIPS 2024
专题命中 图文多模态 :cross-modal(abstract);image-text(abstract);分类 cs.CV
专题命中 图文多模态 :multimodal(abstract);image-text(abstract);分类 cs.CV
专题命中 图文多模态 :multimodal(abstract);image-text(abstract);分类 cs.AI
Comments 8 pages, 4 figs
专题命中 图文多模态 :multimodal(abstract);image-text(abstract);分类 cs.CV
Comments Accepted by ACM MM2024
专题命中 图文多模态 :cross-modal(abstract);分类 cs.CV、cs.CL、cs.AI
Comments ECCV 2024
专题命中 图文多模态 :multi-modal(abstract);image-text(abstract);分类 cs.CV
专题命中 图文多模态 :multimodal(abstract);image-text(abstract);分类 cs.CV
Comments ECCV2024. Code is available at https://github.com/SensenGao/VLPTransferAttack
专题命中 图文多模态 :multimodal(abstract);multi-modal(abstract);分类 cs.CV