Multi-Modal Chorus Recognition for Improving Song Search
专题命中 音频语音多模态 :multi-modal(title,abstract);分类 eess.AS
Comments Accepted at the 30th International Conference on Artificial Neural Networks (ICANN 2021)
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 音频语音多模态 :multi-modal(title,abstract);分类 eess.AS
Comments Accepted at the 30th International Conference on Artificial Neural Networks (ICANN 2021)
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CV
Comments 19 pages, 7 figures
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 eess.AS
Comments 6 pages
专题命中 音频语音多模态 :cross-modal(title,abstract);分类 cs.CV
专题命中 音频语音多模态 :any-to-any(title,abstract);分类 eess.AS
Comments Accepted by INTERSPEECH 2021
专题命中 音频语音多模态 :multimodal(title,abstract);分类 eess.AS
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.AI
专题命中 音频语音多模态 :multi-modal(title,abstract);分类 eess.AS
Comments The Manuscript is submitted to IEEE-EMBS Journal of Biomedical and Health Informatics on June 1, 2021
专题命中 音频语音多模态 :multi-modal(title,abstract);分类 cs.CV
专题命中 音频语音多模态 :cross-modal(title,abstract);分类 eess.AS
Comments 5 pages, 3 figures
Journal ref Proceedings of the 29th European Signal Processing Conference (EUSIPCO 2021), Dublin, Ireland
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CV
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 eess.AS
Comments ICASSP 2021 accepted
专题命中 音频语音多模态 :any-to-any(title,abstract);分类 eess.AS
Comments To appear in the proceedings of ICASSP 2021, equal contribution from first two authors
专题命中 音频语音多模态 :cross-modal(title,abstract);分类 cs.MM
专题命中 音频语音多模态 :multimodal(title,abstract);分类 eess.AS
专题命中 音频语音多模态 :multi-modal(title,abstract);分类 cs.AI
Comments Accepted at IJCNN 2021, to appear in IEEE proceedings. Equal contributions from US, RK and WZ
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 eess.AS
Comments 5 pages
Journal ref Published in International Conference on Acoustics, Speech and Signal Processing (ICASSP), 2021
专题命中 音频语音多模态 :cross-modal(title,abstract);分类 cs.CL
Comments ICASSP 2021; 5 pages
专题命中 音频语音多模态 :cross-modal(title);multi-modal(abstract);分类 cs.CL
Comments To appear in SLT2020
专题命中 音频语音多模态 :multi-modal(title,abstract);分类 cs.CL
Comments 5 pages, Accepted at the International Conference on Machine Learning AI for Social Good Workshop, Long Beach, United States, 2019
Journal ref ICML Workshop on AI for Social Good, 2019
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 eess.AS
Comments Accepted at ISCAS 2021
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 eess.AS
Comments accepted by ICASSP 2021
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 eess.AS
Comments Accepted at ICASSP 2021
专题命中 音频语音多模态 :audio-visual(title);multi-modal(abstract);分类 cs.CV
专题命中 音频语音多模态 :multi-modal(title,abstract);分类 cs.CV
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV
Comments 8 pages
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 eess.AS
Comments Submitted to IEEE/ACM Transactions on Audio, Speech, and Language Processing
Journal ref IEEE/ACM Transactions on Audio, Speech and Language Processing, 28, 2020
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 eess.AS
专题命中 音频语音多模态 :multi-modal(title,abstract);分类 cs.CV
Comments Code: https://github.com/v-iashin/CORSMAL Docker: https://hub.docker.com/r/iashin/corsmal