Towards Robust Multimodal Learning in the Open World
机构 * Department of Computing(计算系)
专题命中 音频语音多模态 :multimodal(title,abstract)
Comments Thesis
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
机构 * Department of Computing(计算系)
专题命中 音频语音多模态 :multimodal(title,abstract)
Comments Thesis
专题命中 音频语音多模态 :audio-visual(title,abstract)
专题命中 音频语音多模态 :multimodal(title,abstract)
机构 * Independent Researcher(独立研究者)
专题命中 音频语音多模态 :multimodal(title,abstract)
机构 * Zhejiang University(浙江大学) ; Shanghai AI Laboratory(上海人工智能实验室)
专题命中 音频语音多模态 :multimodal(title,abstract)
Comments 24 pages
专题命中 音频语音多模态 :multimodal(title,abstract)
机构 * School of Cyberspace Science and Technology(网络空间科学与技术学院) ; Beijing Institute of Technology(北京理工大学) ; Sun Yat-sen University(中山大学) ; Qilu University of Technology(齐鲁工业大学) ; Shandong Computer Science Center(山东计算机科学中心) ; School of Information and Electronics(信息电子学院)
专题命中 音频语音多模态 :audio-visual(title,abstract)
机构 * Faculty of Engineering and Architecture, IDLab-AIRO, Ghent University – imec, Technologiepark 126, 9052 Gent, Belgium(工程与建筑学院,IDLab-AIRO,根特大学–imec,Technologiepark 126,9052 Gent,比利时)
专题命中 音频语音多模态 :multimodal(title,abstract)
专题命中 音频语音多模态 :multimodal(title,abstract)
Comments 18 pages, 5 figures, 4 tables
专题命中 音频语音多模态 :multimodal(title,abstract)
专题命中 音频语音多模态 :multimodal(title,abstract)
Comments Accepted by IEEE Transactions on Audio, Speech and Language Processing
机构 * School of Systems & Computing, UNSW Canberra(系统与计算学院,UNSW堪培拉) ; School of Computer Science and Engineering, UNSW Sydney(计算机科学与工程学院,UNSW悉尼)
专题命中 音频语音多模态 :multimodal(title,abstract)
Comments This paper has been accepted and presented at the 16th International Conference on Swarm Intelligence (ICSI 2025), held on July 11-15, 2025, in Yokohama, Japan
专题命中 音频语音多模态 :multimodal(title,abstract)
专题命中 音频语音多模态 :multimodal(title,abstract)
专题命中 音频语音多模态 :multimodal(title,abstract)
Comments Ubicomp Companion 2025
机构 * School of Marine Science and Technology, Northwestern Polytechnical University, Xi’an, China(海洋科学与技术学院,西北工业大学,西安,中国) ; School of Automation, Northwestern Polytechnical University, Xi’an, China(自动化学院,西北工业大学,西安,中国) ; School of Electrical Engineering, KAIST, Daejeon, Republic of Korea(电气工程学院,韩国成均馆大学,大田,韩国)
专题命中 音频语音多模态 :multimodal(title,abstract)
专题命中 音频语音多模态 :multimodal(title,abstract)
机构 * University of Science and Technology of China(中国科学技术大学) ; Hong Kong Polytechnic University(香港理工大学)
专题命中 音频语音多模态 :any-to-any(title,abstract)
机构 * Department of Computer Science and Engineering, Chandigarh University, Mohali, Punjab, India(昌迪加尔大学计算机科学与工程系,莫哈利,旁遮普,印度) ; Department of Computer Science and Engineering, Manav Rachna International Institute of Research and Studies(曼纳瓦拉国际研究与学习研究所计算机科学与工程系)
专题命中 音频语音多模态 :multi-modal(title,abstract)
专题命中 音频语音多模态 :multimodal(title,abstract)
专题命中 音频语音多模态 :multimodal(title,abstract)
专题命中 音频语音多模态 :multi-modal(title,abstract)
专题命中 音频语音多模态 :multimodal(title,abstract)
机构 * Faculty of Engineering and Architecture(工程与建筑学院) ; IDLab-AIRO, Ghent University – imec(IDLab-AIRO,根特大学–imec) ; Department of Engineering Science, University of Oxford(工程科学系,牛津大学)
专题命中 音频语音多模态 :multimodal(title,abstract)
专题命中 音频语音多模态 :multimodal(title,abstract)
Comments Accepted to IEEE VIS 2025
机构 * Department of Computer Science, University of Bari Aldo Moro, Italy(巴里阿尔多·莫罗大学计算机科学系)
专题命中 音频语音多模态 :cross-modal(title);分类 cs.CV、cs.MM、eess.AS
Comments Presented at the AI for Visual Arts (AI4VA) workshop at ECCV 2024
机构 * Johannes Kepler University Linz(约翰· Kepler大学林茨) ; Criteo AI Lab(Criteo人工智能实验室) ; Deezer Research(Deezer研究) ; Johannes Kepler University Linz and Linz Institute of Technology(约翰· Kepler大学林茨和林茨技术学院)
专题命中 音频语音多模态 :multimodal(title,abstract)
专题命中 音频语音多模态 :multimodal(title,abstract)
专题命中 音频语音多模态 :multimodal(title,abstract)
Comments Accepted by Interspeech 2025
专题命中 音频语音多模态 :multimodal(title,abstract)
Comments 28 pages, 10 figures