Leveraging the Video-level Semantic Consistency of Event for Audio-visual Event Localization
专题命中 音频语音多模态 :audio-visual(title,abstract);cross-modal(abstract);分类 cs.CV、cs.AI
Comments 13 pages, 10 figures, Accepted by IEEE Transactions on Multimedia
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 音频语音多模态 :audio-visual(title,abstract);cross-modal(abstract);分类 cs.CV、cs.AI
Comments 13 pages, 10 figures, Accepted by IEEE Transactions on Multimedia
专题命中 音频语音多模态 :multimodal(title,abstract);multi-modal(abstract);分类 cs.AI、eess.AS
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CV、cs.CL、cs.AI
Comments 22 pages, 14 figures
专题命中 音频语音多模态 :audio-visual(title,abstract);multi-modal(abstract);分类 cs.CV、eess.AS
Comments 7 pages, 6 figures
专题命中 音频语音多模态 :multimodal(title,abstract);cross-modal(abstract);分类 cs.CL、eess.AS
Comments 16 pages, 9 figures
专题命中 音频语音多模态 :multi-modal(title,abstract);image-text(abstract);分类 cs.MM、eess.AS
Comments Findings of EMNLP 2023, project: https://github.com/Sosdatasets/SoS_Dataset/
专题命中 音频语音多模态 :audio-visual(title,abstract);multimodal(abstract);分类 cs.CV、eess.AS
Comments NeurIPS 2023
专题命中 音频语音多模态 :audio-visual(title,abstract);multimodal(abstract);分类 cs.CV、cs.AI
Comments 8 pages, 3 figures
专题命中 音频语音多模态 :audio-visual(title,abstract);multi-modal(abstract);分类 cs.CV、eess.AS
Comments NeurIPS 2023
专题命中 音频语音多模态 :audio-visual(title,abstract);cross-modal(abstract);分类 cs.CV、cs.MM
Comments ICCV 2023. arXiv admin note: text overlap with arXiv:2303.17056
专题命中 音频语音多模态 :cross-modal(title,abstract);multimodal(abstract);分类 cs.CV、cs.AI
Comments Accepted at the IEEE ICDL-EPIROB 2017 Workshop on Computational Models for Crossmodal Learning (CMCML), 4 pages, 6 figures
专题命中 音频语音多模态 :audio-visual(title,abstract);multi-modal(abstract);分类 cs.CV、cs.MM
Comments Accepted by ACM MM 2023
专题命中 音频语音多模态 :audio-visual(title,abstract);multimodal(abstract);分类 cs.CV、cs.AI
Comments 11 pages, 6 figures
专题命中 音频语音多模态 :audio-visual(title,abstract);multimodal(abstract);分类 cs.CV、eess.AS
Comments 12 pages, 5 figures, to be published in CICAI2023
专题命中 音频语音多模态 :multi-modal(title,abstract);cross-modal(abstract);分类 cs.CV、cs.AI
专题命中 音频语音多模态 :multi-modal(title,abstract);cross-modal(abstract);分类 cs.CV、cs.MM
专题命中 音频语音多模态 :multimodal(title,abstract);cross-modal(abstract);分类 cs.CL、eess.AS
Comments InterSpeech 2023 Main Conference
专题命中 音频语音多模态 :audio-visual(title,abstract);cross-modal(abstract);分类 cs.CL、eess.AS
Comments Accepted to ACL 2023
专题命中 音频语音多模态 :multimodal(title,abstract);audio-visual(abstract);分类 cs.MM、eess.AS
专题命中 音频语音多模态 :multimodal(title,abstract);image-text(abstract);分类 cs.MM、eess.AS
Comments 5 pages including references
专题命中 音频语音多模态 :audio-visual(title,abstract);multimodal(abstract);分类 cs.CV、eess.AS
专题命中 音频语音多模态 :audio-visual(title,abstract);multi-modal(abstract);分类 cs.MM、eess.AS
Comments Accepted by SLT 2022
专题命中 音频语音多模态 :audio-visual(title,abstract);cross-modal(abstract);分类 cs.MM、eess.AS
专题命中 音频语音多模态 :audio-visual(title,abstract);cross-modal(abstract);分类 cs.CV、eess.AS
Comments ECCV 2022
专题命中 音频语音多模态 :audio-visual(title,abstract);multimodal(abstract);分类 cs.CV、cs.MM
Comments ACM MM 2022
专题命中 音频语音多模态 :audio-visual(title,abstract);cross-modal(abstract);分类 cs.CV、eess.AS
Comments Paper accepted to Interspeech 2022; Project Page: https://ipcv.github.io/VocaLiST/
专题命中 音频语音多模态 :multimodal(title,abstract);multi-modal(abstract);分类 cs.CV、cs.AI
专题命中 音频语音多模态 :audio-visual(title,abstract);multimodal(abstract);分类 cs.CL、cs.AI
Comments 6 pages
专题命中 音频语音多模态 :cross-modal(title,abstract);audio-visual(abstract);分类 cs.CV、eess.AS
Comments Accepted by AAAI Conference on Artificial Intelligence (AAAI) 2022. 16 pages
专题命中 音频语音多模态 :audio-visual(title,abstract);multi-modal(abstract);分类 cs.CV、eess.AS