TagGPT: Large Language Models are Zero-shot Multimodal Taggers
专题命中 音频语音多模态 :multimodal(title,abstract)
Comments 13 pages, 6 figures
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 音频语音多模态 :multimodal(title,abstract)
Comments 13 pages, 6 figures
专题命中 音频语音多模态 :multimodal(title,abstract)
专题命中 音频语音多模态 :cross-modal(title,abstract)
Comments 4 pages, 5 figures, 11th International IEEE EMBS Conference on Neural Engineering (NER)
专题命中 音频语音多模态 :cross-modal(title,abstract)
专题命中 音频语音多模态 :multimodal(title,abstract)
专题命中 音频语音多模态 :multimodal(title,abstract)
Journal ref Proceedings of the ACM on Human-Computer Interaction Volume 4 Issue ISS November 2020
专题命中 音频语音多模态 :multimodal(title,abstract)
Comments New Interfaces for Musical Expression 2022 Demo Paper
专题命中 音频语音多模态 :audio-visual(title);分类 cs.CV、cs.MM、eess.AS
Comments 5 pages, 2 figures, submitted to INTERSPEECH 2022
专题命中 音频语音多模态 :audio-visual(title);分类 cs.CV、cs.MM、eess.AS
Comments 5 pages, 2 figures, 1 table; accepted at ICASSP 2022; Challenge webpage, see https://corsmal.eecs.qmul.ac.uk/challenge.html
专题命中 音频语音多模态 :multimodal(title,abstract)
Comments 12 pages, IoTDI '22, May 3-6, 2022, Milan, Italy
专题命中 音频语音多模态 :audio-visual(title,abstract)
专题命中 音频语音多模态 :multi-modal(title,abstract)
专题命中 音频语音多模态 :multimodal(title,abstract)
Comments Presented at AI-HRI symposium as part of AAAI-FSS 2021 (arXiv:2109.10836)
专题命中 音频语音多模态 :audio-visual(title,abstract)
专题命中 音频语音多模态 :audio-visual(title);multimodal(abstract)
Comments 8 pages, 4 figures, 2 tables, published in IEEE Access
Journal ref in IEEE Access, vol. 9, pp. 131574-131582, 2021
专题命中 音频语音多模态 :audio-visual(title,abstract)
专题命中 音频语音多模态 :multimodal(title,abstract)
专题命中 音频语音多模态 :multimodal(title);multi-modal(abstract)
Comments Our code is available at: https://github.com/yangland/hatefulchallenge
专题命中 音频语音多模态 :audio-visual(title,abstract)
专题命中 音频语音多模态 :audio-visual(title);分类 cs.CV、cs.CL、eess.AS
Comments To appear at CVPR 2021
专题命中 音频语音多模态 :audio-visual(title);分类 cs.CV、cs.MM、eess.AS
Comments AAAI'21
专题命中 音频语音多模态 :audio-visual(title,abstract)
Journal ref in IEEE Access, vol. 9, pp. 37431-37455, 2021
专题命中 音频语音多模态 :multimodal(title,abstract)
Journal ref Behaviour & Information Technology, 2020
专题命中 音频语音多模态 :multimodal(title,abstract)
专题命中 音频语音多模态 :cross-modal(title);multimodal(abstract)
Journal ref Proceedings of the International Conference on New Interfaces for Musical Expression, 2017
专题命中 音频语音多模态 :multimodal(title,abstract)
Comments Preprint
专题命中 音频语音多模态 :multi-modal(title,abstract)
专题命中 音频语音多模态 :multimodal(title,abstract)
Comments Presented at the CHI 2020 Designing Interactions for the Ageing Populations Addressing Global Challenges Workshop
专题命中 音频语音多模态 :audio-visual(title);分类 cs.CV、cs.CL、eess.AS
Comments Accepted by BMVC 2020. More experiments. Code: https://github.com/v-iashin/bmt Project page: https://v-iashin.github.io/bmt
专题命中 音频语音多模态 :multimodal(title,abstract)