Multi-modal expressive personality recognition in data non-ideal audiovisual based on multi-scale feature enhancement and modal augment
专题命中 音频语音多模态 :multi-modal(title);multimodal(abstract);audio-visual(abstract);分类 cs.AI
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 音频语音多模态 :multi-modal(title);multimodal(abstract);audio-visual(abstract);分类 cs.AI
专题命中 音频语音多模态 :audio-visual(title,abstract);multi-modal(abstract);分类 cs.CV
Comments Accepted by NeurIPS 2024
专题命中 音频语音多模态 :audio-visual(title,abstract);multi-modal(abstract);分类 cs.CV
Comments Accepted by ICLR 2025
专题命中 音频语音多模态 :audio-visual(title,abstract);multimodal(abstract);分类 cs.CV
专题命中 音频语音多模态 :audio-visual(title,abstract);multimodal(abstract);分类 eess.AS
Comments accepted to ESWA journal
专题命中 音频语音多模态 :multimodal(title,abstract);MLLM(abstract);分类 cs.MM
Comments Accepted by TheWebConf (WWW) 2025
专题命中 音频语音多模态 :multimodal(title,abstract);cross-modal(abstract);分类 cs.CV
专题命中 音频语音多模态 :multi-modal(title,abstract);audio-visual(abstract);分类 eess.AS
Journal ref 2022 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR)
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CV、cs.CL、cs.MM
Comments 10 pages, 6 figures, 3 tables
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、cs.CL、cs.MM
Comments Accepted at ICASSP, 4 pages
专题命中 音频语音多模态 :audio-visual(title,abstract);multi-modal(abstract);分类 cs.AI
Comments 12 pages, 9 figures, 9 tables
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、cs.AI、cs.MM
Comments arXiv admin note: text overlap with arXiv:2202.13673
专题命中 音频语音多模态 :audio-visual(title);multimodal(abstract);分类 cs.CV、cs.AI、cs.MM
Comments 11 pages, 18 figures
专题命中 音频语音多模态 :audio-visual(title,abstract);multi-modal(abstract);分类 cs.CV
Comments EMNLP 2024
专题命中 音频语音多模态 :multi-modal(title,abstract);分类 cs.CV、cs.CL、cs.AI
专题命中 音频语音多模态 :audio-visual(title,abstract);cross-modal(abstract);分类 cs.CV
Comments ACCV 2024
专题命中 音频语音多模态 :multimodal(title,abstract);cross-modal(abstract);分类 cs.CV
Comments Project Page: cmm-damovl.site
专题命中 音频语音多模态 :audio-visual(title,abstract);cross-modal(abstract);分类 cs.CV
专题命中 音频语音多模态 :multimodal(title,abstract);image-text(abstract);分类 cs.CL
专题命中 音频语音多模态 :audio-visual(title,abstract);multimodal(abstract);分类 cs.CV
Comments 27th International Conference on Information (FUSION)
专题命中 音频语音多模态 :multi-modal(title,abstract);multimodal(abstract);分类 cs.CV
Comments The paper will appear in the CVPR 2024 workshops proceedings
Journal ref Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) Workshops, 2024, pp. 4604-4614
专题命中 音频语音多模态 :multi-modal(title,abstract);分类 cs.CV、cs.CL、cs.AI
专题命中 音频语音多模态 :multimodal(title,abstract);audio-visual(abstract);分类 cs.CV
专题命中 音频语音多模态 :multimodal(title,abstract);MLLM(abstract);分类 cs.AI
专题命中 音频语音多模态 :cross-modal(title,abstract);multimodal(abstract);分类 cs.CL
Comments Appeared at the 13th edition of the Workshop on Cognitive Modeling and Computational Linguistics (CMCL 2024)
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CV、cs.CL、cs.AI
专题命中 音频语音多模态 :audio-visual(title,abstract);cross-modal(abstract);分类 cs.CV
Comments Accepted at ECCV 2024
专题命中 音频语音多模态 :audio-visual(title,abstract);multimodal(abstract);分类 cs.CV
Comments INTERSPEECH 2024
专题命中 音频语音多模态 :multi-modal(title,abstract);分类 cs.CV、cs.CL、cs.AI
Comments Accepted by SIGIR 2024 as a full paper
专题命中 音频语音多模态 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV