Audio-visual scene classification via contrastive event-object alignment and semantic-based fusion
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.MM、eess.AS
Comments IEEE MMSP 2022
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.MM、eess.AS
Comments IEEE MMSP 2022
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、eess.AS
Comments Accepted to ECCV 2022
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、eess.AS
Comments Accepted to ECCV 2022
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、eess.AS
Comments Interspeech 2022
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、eess.AS
Comments Interspeech 2022
专题命中 音频语音多模态 :audio-visual(title);multi-modal(abstract);分类 cs.CV、eess.AS
Comments CVPR 2022. Project page: http://fallen-object.csail.mit.edu
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CL、eess.AS
专题命中 音频语音多模态 :cross-modal(title,abstract);分类 cs.CL、eess.AS
Comments Accepted by Interspeech2022
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.MM、eess.AS
Comments Accepted by Interspeech 2022. arXiv admin note: substantial text overlap with arXiv:2101.06268
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、eess.AS
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.AI、eess.AS
Comments 8 pages, 4 figures, Text, Speech and Dialogue 2022 Conference
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、eess.AS
Comments CVPR 2022 Embodied AI Workshop
专题命中 音频语音多模态 :multimodal(title);audio-visual(abstract);分类 cs.CL、eess.AS
Comments Accepted at LREC 2022
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、eess.AS
Comments arXiv admin note: text overlap with arXiv:2205.05586
专题命中 音频语音多模态 :cross-modal(title,abstract);分类 cs.CL、eess.AS
Comments NAACL 2022 main conference (Long Paper)
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.MM、eess.AS
Comments PhD Thesis. Author: F. Simonetta; tutor: S. Ntalampiras; co-tutor: F. Avanzini; Università degli studi di Milano - Dipartimento di Informatica "Giovanni Degli Antoni", 2022 Apr 22
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、cs.MM
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CV、cs.AI
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、cs.MM
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CL、eess.AS
Comments Submitted to Interspeech 2022
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CL、eess.AS
Comments 5 pages, 3 figures, 3 tables, 28 citations
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、eess.AS
专题命中 音频语音多模态 :multi-modal(title,abstract);分类 cs.CL、eess.AS
Comments Accepted by ICASSP 2022
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CV、cs.AI
Comments Accepted by CVPR 2022 (ORAL)
专题命中 音频语音多模态 :multi-modal(title,abstract);分类 cs.CL、eess.AS
Comments 2022 IEEE International Conference on Acoustics, Speech and Signal Processing
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CL、cs.MM
Comments 11 pages, 7 figures. This paper is accepted by IEEE VIS, 2021. To appear in IEEE Transactions on Visualization and Computer Graphics (TVCG)
Journal ref IEEE Transactions on Visualization and Computer Graphics 28, no. 1 (2021): 802-812
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、eess.AS
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CL、eess.AS
Comments Accepted to ICASSP 2022. arXiv admin note: text overlap with arXiv:2104.04195
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、eess.AS
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CL、cs.AI
Comments 5 pages, accepted by ICASSP'2022