Late Audio-Visual Fusion for In-The-Wild Speaker Diarization
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CL、eess.AS
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CL、eess.AS
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CL、eess.AS
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.MM、eess.AS
Comments Interspeech 2023
Journal ref Proc. INTERSPEECH 2023, 3719-3723
专题命中 音频语音多模态 :multimodal(title);multi-modal(abstract);分类 cs.CV、cs.MM
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CL、cs.AI
Comments Accepted to IEEE TRANSACTIONS ON COGNITIVE DEVELOPMENTAL SYSTEMS
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、eess.AS
Comments IROS2023
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CL、eess.AS
Comments Under Review IEEE TAC
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.AI、eess.AS
Comments IEEE/ACM Transactions on Audio, Speech, and Language Processing
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、eess.AS
Comments Accepted to ICASSP 2023
专题命中 音频语音多模态 :audio-visual(title);multi-modal(abstract);分类 cs.MM、eess.AS
Comments Accepted by ICASSP2023
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CL、eess.AS
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CL、eess.AS
Comments 5 pages, 2 figures, 4 tables
Journal ref Published in ICASSP 2023 - 2023 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP)
专题命中 音频语音多模态 :cross-modal(title,abstract);分类 cs.CL、cs.AI
Comments Accepted at ACL 2023 main conference
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CL、eess.AS
Comments Accepted at INTERSPEECH 2023
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.AI、eess.AS
Comments 5 pages, accepted for presentation at INTERSPEECH 2023
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CV、cs.AI
Comments 5 pages, 3 figures
Journal ref ICASSP 2023
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CL、eess.AS
Comments Accepted by Interspeech 2023
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.AI、eess.AS
Comments arXiv admin note: substantial text overlap with arXiv:2208.01917
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、eess.AS
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CL、cs.MM
Comments 4 tables, 4 figures
专题命中 音频语音多模态 :multi-modal(title,abstract);分类 cs.CL、eess.AS
Comments 5 pages, 1 figures, 2 tables. Accepted by ICASSP 2023
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CV、cs.CL
Comments ICLR 2023. Code available at https://github.com/lzcemma/LeMDA/
专题命中 音频语音多模态 :cross-modal(title,abstract);分类 cs.CV、cs.CL
Journal ref IEEE/ACM TRANSACTIONS ON AUDIO, SPEECH, AND LANGUAGE PROCESSING, VOL. 31, 2023
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.MM、eess.AS
Comments 6 pages. 1 figure. arXiv admin note: substantial text overlap with arXiv:2203.13031
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CL、cs.AI
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、cs.MM
Comments CVPR 2023
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.AI、eess.AS
专题命中 音频语音多模态 :cross-modal(title,abstract);分类 cs.CV、eess.AS
Comments 5 pages (including references), 1 figure
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、eess.AS
Comments accepted to ICASSP 2023
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CL、eess.AS