Learning to Answer Questions in Dynamic Audio-Visual Scenarios
专题命中 音频语音多模态 :audio-visual(title,abstract);multimodal(abstract);分类 cs.CV
Comments Accepted by CVPR2022 (Oral presentation)
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 音频语音多模态 :audio-visual(title,abstract);multimodal(abstract);分类 cs.CV
Comments Accepted by CVPR2022 (Oral presentation)
专题命中 音频语音多模态 :multi-modal(title,abstract);cross-modal(abstract);分类 cs.MM
Comments Accepted at ICASSP 2022
专题命中 音频语音多模态 :cross-modal(title,abstract);分类 cs.CV、cs.AI、cs.MM
Comments Accepted to ICASSP 2022. Demo page is available at https://wendison.github.io/VCVTS-demo/
专题命中 音频语音多模态 :multi-modal(title,abstract);multimodal(abstract);分类 eess.AS
专题命中 音频语音多模态 :audio-visual(title,abstract);multimodal(abstract);分类 eess.AS
专题命中 音频语音多模态 :multimodal(title,abstract);cross-modal(abstract);分类 cs.CV
Comments 19 pages, 10 figures
专题命中 音频语音多模态 :cross-modal(title,abstract);audio-visual(abstract);分类 cs.CV
Comments 9 pages, 6 figures, update template
专题命中 音频语音多模态 :audio-visual(title,abstract);multimodal(abstract);分类 cs.CV
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、cs.CL、cs.MM
Comments Presented at Interspeech 2021. This version contains updated results using the YouCook-Japanese dataset
专题命中 音频语音多模态 :multimodal(title,abstract);audio-visual(abstract);分类 cs.CV
Comments Accepted at IEEE International Conference on Automatic Face and Gesture Recognition (FG 2021), copyright 2021 IEEE
专题命中 音频语音多模态 :audio-visual(title,abstract);multi-modal(abstract);分类 cs.CV
Comments 10 pages, 6 figures
专题命中 音频语音多模态 :audio-visual(title,abstract);multimodal(abstract);分类 eess.AS
Comments Paper accepted at The 32nd British Machine Vision Conference, BMVC 2021
专题命中 音频语音多模态 :audio-visual(title,abstract);cross-modal(abstract);分类 cs.CV
专题命中 音频语音多模态 :audio-visual(title,abstract);multimodal(abstract);分类 cs.CL
Comments https://dstc10.dstc.community/home and https://github.com/dialogtekgeek/AVSD-DSTC10_Official/
专题命中 音频语音多模态 :audio-visual(title,abstract);multimodal(abstract);分类 cs.CV
Comments Published to ICCV2021
专题命中 音频语音多模态 :multi-modal(title,abstract);audio-visual(abstract);分类 cs.CV
专题命中 音频语音多模态 :audio-visual(title,abstract);multi-modal(abstract);分类 eess.AS
Journal ref The IEEE 23rd International Workshop on Multimedia Signal Processing (MMSP), 2021
专题命中 音频语音多模态 :audio-visual(title,abstract);cross-modal(abstract);分类 cs.CV
专题命中 音频语音多模态 :audio-visual(title,abstract);multi-modal(abstract);分类 eess.AS
专题命中 音频语音多模态 :audio-visual(title,abstract);multimodal(abstract);分类 cs.CV
Comments Accepted at ICASSP 2021 \c{opyright} 2021 IEEE. Personal use of this material is permitted. Permission from IEEE must be obtained for all other uses, in current or future media, including reprinting/republishing this material for advertising or promotional purposes, creating new collective works, for resale or redistribution to servers or lists, or reuse of copyrighted components of this work
专题命中 音频语音多模态 :multimodal(title,abstract);multi-modal(abstract);分类 cs.MM
Comments Appearing in the proceedings of the 21st International Society for Music Information Retrieval Conference (ISMIR 2020) (camera-ready version)
Journal ref International Society for Music Information Retrieval Conference, (2020) 54-61
专题命中 音频语音多模态 :audio-visual(title,abstract);multi-modal(abstract);分类 cs.CV
Comments 11 pages, 7 figures
专题命中 音频语音多模态 :multi-modal(title,abstract);multimodal(abstract);分类 cs.CV
Comments Neural Comput & Applic (2021)
专题命中 音频语音多模态 :audio-visual(title,abstract);cross-modal(abstract);分类 cs.CV
专题命中 音频语音多模态 :audio-visual(title,abstract);multimodal(abstract);分类 eess.AS
专题命中 音频语音多模态 :audio-visual(title,abstract);cross-modal(abstract);分类 eess.AS
专题命中 音频语音多模态 :audio-visual(title,abstract);multimodal(abstract);分类 eess.AS
Comments Accepted for ICASSP 2021, 5 pages
专题命中 音频语音多模态 :multimodal(title);multi-modal(abstract);audio-visual(abstract);分类 eess.AS
Comments 7 pages, 5 figures
Journal ref in IEEE Spoken Language Technology Workshop (SLT), 2021, pp. 778-784
专题命中 音频语音多模态 :multimodal(title,abstract);audio-visual(abstract);分类 eess.AS
Comments IEEE Spoken Language Technology Workshop 2021
专题命中 音频语音多模态 :multimodal(title,abstract);multi-modal(abstract);分类 cs.CV
Comments To appear in the Thirty-Fourth Annual Conference on Neural Information Processing Systems (NeurIPS 2020)