Sequence-to-Sequence Multi-Modal Speech In-Painting
专题命中 音频语音多模态 :multi-modal(title,abstract);分类 cs.AI、cs.MM、eess.AS
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 音频语音多模态 :multi-modal(title,abstract);分类 cs.AI、cs.MM、eess.AS
专题命中 音频语音多模态 :multi-modal(title,abstract);分类 cs.AI、cs.MM、eess.AS
专题命中 音频语音多模态 :multimodal(title);multi-modal(abstract);分类 cs.CL、cs.MM、eess.AS
Comments Accepted by ICASSP 2024
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、cs.MM、eess.AS
Comments 24 pages
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CV、cs.CL、cs.MM
Comments Ranked 3rd in SemEval '24 Task 3 with F1 of 0.3435, close to 1st & 2nd by 0.0339 & 0.0025
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、cs.AI、eess.AS
Comments CVPR 2024 Highlight. 13 pages, 10 figures
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、cs.MM、eess.AS
Comments Accepted by Information Fusion. The code is available at https://github.com/sunlicai/HiCMAE
Journal ref Information Fusion, 2024
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、cs.MM、eess.AS
Comments Accepted to CVPR 2024. Project site: https://facebookresearch.github.io/real-acoustic-fields/
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、cs.MM、eess.AS
Comments Accepted to ICASSP 2024; Evaluation Code: https://github.com/roger-tseng/av-superb Submission Platform: https://av.superbbenchmark.org
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、cs.MM、eess.AS
Comments Accepted to NeurIPS2023
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、cs.MM、eess.AS
Comments Accepted To ICASSP2024
专题命中 音频语音多模态 :cross-modal(title,abstract);分类 cs.CV、cs.MM、eess.AS
Comments SPIE Medical Imaging 2024: Image Processing
专题命中 音频语音多模态 :cross-modal(title,abstract);分类 cs.CL、cs.MM、eess.AS
Comments 18 pages, 7 figures
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、cs.MM、eess.AS
Comments Accepted by AAAI 2024
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CL、cs.AI、eess.AS
Comments 2023 ASRU
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、cs.CL、cs.AI
Comments Accepted at AAAI 2024
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、cs.CL、eess.AS
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、cs.MM、eess.AS
Comments 4 pages, 3 figures
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、cs.MM、eess.AS
Comments 27 pages, 9 figures, accepted for publication in NeurIPS 2023 Track on Datasets and Benchmarks
专题命中 音频语音多模态 :multimodal(title,abstract);分类 cs.CV、cs.CL、cs.AI
Comments The 2023 Conference on Empirical Methods in Natural Language Processing (EMNLP): Findings
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、cs.AI、cs.MM
Comments Camera-ready version for WACV 2024; project page is https://jinxiang-liu.github.io/anno-free-AVS/
专题命中 音频语音多模态 :multimodal(title,abstract);cross-modal(abstract)
Comments Accepted at 7th Conference on Robot Learning (CoRL 2023), Atlanta, USA
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、cs.MM、eess.AS
Comments Published at the CVPR 2023 Sight and Sound workshop
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、cs.CL、cs.AI
Comments Accepted at CVPR 2023
专题命中 音频语音多模态 :audio-visual(title);multimodal(abstract);分类 cs.AI、cs.MM、eess.AS
Comments 5 pages, 4 figures
Journal ref The 31st ACM International Conference on Multimedia (MM'23), 2023
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、cs.AI、cs.MM
Comments Camera-Ready, ACM MM 2023
专题命中 音频语音多模态 :audio-visual(title,abstract);multi-modal(abstract)
Comments 18 pages, published in UIST'23
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、cs.MM、eess.AS
Comments INTERSPEECH 2023
专题命中 音频语音多模态 :audio-visual(title,abstract);分类 cs.CV、cs.MM、eess.AS
Comments 19 pages, 9 figures, Accepted by ACL 2023
专题命中 音频语音多模态 :multi-modal(title,abstract);分类 cs.CV、cs.CL、cs.AI
Comments Longyue Wang is the corresponding author. Our project page is at https://github.com/lyuchenyang/Macaw-LLM