Improving Audio-Visual Video Parsing with Pseudo Visual Labels
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、cs.MM
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、cs.MM
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、eess.AS
专题命中 音频语音多模态 :cross-modal(title,abstract);分类 cs.CV、eess.AS
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CL、cs.AI
Comments 5 pages, 2 figures, 3 tables. Submitted to ICASSP 2023
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CL、cs.AI
专题命中 音频语音多模态 :multi-modal(title,abstract);分类 cs.CL、cs.MM
Comments Accepted in ACM CSUR 2023
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CL、cs.MM
Comments Accepted in EMNLP, 2022
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CV、cs.AI
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CV、eess.AS
Comments IEEE International Ultrasonic Symposium 2022
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CV、eess.AS
Comments arXiv admin note: text overlap with arXiv:2208.11450
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、eess.AS
Comments This paper has been accepted for publication at IEEE ROBOTICS AND AUTOMATION LETTERS
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、cs.AI
Comments 19 pages, 8 figures, 9 tables
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CL、cs.AI
Comments arXiv admin note: text overlap with arXiv:2107.00648 by other authors
Journal ref Pre-print for our paper at International Conference on Speech & Language Technology for Low-resource Languages (SPELLL'2022)
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.MM、eess.AS
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CL、cs.AI
Comments 6 pages,1 figure
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、cs.AI
Comments Accepted to SIGGRAPH Asia 2022 (Conference Proceedings). Project page: https://hangz-nju-cuhk.github.io/projects/AV-CAT
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.MM、eess.AS
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CL、eess.AS
Comments Submitted to ICASSP 2023. arXiv admin note: text overlap with arXiv:2203.16794
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、eess.AS
Comments Accepted to NeurIPS 2022
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CL、eess.AS
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CV、cs.AI
Comments 11 Pages, Accepted at ICMI 2022 Oral
专题命中 音频语音多模态 :multi-modal(title,abstract);分类 cs.CL、eess.AS
Comments 5 pages, 3 figures, 3 tables
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、eess.AS
Comments 5 pages, 3 figures, published at Interspeech 2022
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、eess.AS
Comments Accepted at NeurIPS 2022
专题命中 音频语音多模态 :cross-modal(title,abstract);分类 cs.CL、eess.AS
Comments Accepted by the main conference of EMNLP 2022
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.AI、eess.AS
Comments Main paper (10 pages and 7 figures) and appendix (21 figures and 4 tables). Accepted for publication by BMVC 2022. For data and code, see https://yyf17.github.io/FSAAVN/index.html
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、cs.MM
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CV、cs.CL
Comments accepted to CECEO22@IJCAI
专题命中 音频语音多模态 :cross-modal(title,abstract);分类 cs.MM、eess.AS
Journal ref International Joint Conference on Neural Networks, IJCNN 2022, Padua, Italy, 1-8
专题命中 音频语音多模态 :cross-modal(title,abstract);分类 cs.MM、eess.AS