Linked Multi-Modal Data on Russian Domestic and Foreign Policy Speeches
连接多模型数据:俄罗斯国内与对外政策演讲
Daria Blinova, Gayathri Emuru, Rakesh Emuru, Kushagradheer Shridheer Srivastava, Mina Rulis, Sunita Chandrasekaran, Benjamin E. Bagozzi
机构
*
University of Delaware, Department of Political Science & International Relations(德克萨斯大学,政治科学与国际关系系)
;
University of Delaware, Masters of Science in Data Science Program(德克萨斯大学,数据科学硕士项目)
;
University of Delaware, Department of Computer & Information Sciences(德克萨斯大学,计算机与信息科学系)
;
University of Pennsylvania, Department of Political Science(宾夕法尼亚大学,政治科学系)
机构
*
Peking University(北京大学)
;
Kling Team, Kuaishou Technology(快手团队)
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
Sun Yat-sen University(中山大学)
机构
*
Department of Computing, Imperial College London(伦敦帝国理工学院计算系)
;
Department of Earth Science & Engineering, Imperial College London(伦敦帝国理工学院地球科学与工程系)
;
Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)
;
Department of Computer Science, Heriot-Watt University(赫瑞瓦特大学计算机科学系)
;
School of Computer Science, Northumbria University(诺森比亚大学计算机科学学院)
;
College of Computer Science & Software Engineering, Shenzhen University(深圳大学计算机科学与软件学院)
;
School of Artificial Intelligence, Shenzhen University(深圳大学人工智能学院)
;
Guangdong Provincial Key Laboratory of Intelligent Information Processing, Shenzhen University(深圳大学广东省智能信息处理重点实验室)
;
School of Engineering and Design, Hunan Normal University(湖南师范大学工程与设计学院)
;
Department of Computer Science, University of Oxford(牛津大学计算机科学系)
;
Department of Computer Science, University of Exeter(埃克塞特大学计算机科学系)
Omnilingual SONAR: Cross-Lingual and Cross-Modal Sentence Embeddings Bridging Massively Multilingual Text and Speech
Omnilingual SONAR:跨语言与跨模态句子嵌入,连接大规模多语言文本与语音
Omnilingual SONAR Team, João Maria Janeiro, Pere-Lluís Huguet Cabot, Ioannis Tsiamas, Yen Meng, Vivek Iyer, Guillem Ramírez, Loic Barrault, Belen Alastruey, Xiang "Tony" Cao, Yu-An Chung, Marta R. Costa-Jussa, David Dale, Kevin Heffernan, Jaehyeong Jo, Artyom Kozhevnikov, Alexandre Mourachko, Christophe Ropers, Holger Schwenk, Paul-Ambroise Duquenne
Learning Robust Pair Confidence for Multimodal Emotion-Cause Pair Extraction
学习鲁棒的成对置信度用于多模态情感-原因对提取
Zhuangzhuang Pan, Ning Dong, Yingna Su, Yan Xia
机构
*
Institute for Advanced Studies(先进研究院)
;
Universiti Malaya(马来大学)
;
School of Information Engineering(信息工程学院)
;
Suqian University(宿州学院)
;
Digitization Department(数字化部门)
M*: A Modular, Extensible, Serving System for Multimodal Models
M*: 一个模块化、可扩展的多模态模型服务系统
Atindra Jha, Naomi Sagan, Keisuke Kamahori, Irmak Sivgin, Rohan Sanda, Steven Gao, Mark Horowitz, Luke Zettlemoyer, Olivia Hsu, Jure Leskovec, Baris Kasikci, Stephanie Wang
机构
*
Stanford University(斯坦福大学)
;
University of Washington(华盛顿大学)
;
Carnegie Mellon University(卡内基梅隆大学)
机构
*
College of Computer Science, Nankai University, Tianjin, China(南开大学计算机科学学院,天津,中国)
;
Academy for Advanced Interdisciplinary Studies, Nankai University, Tianjin, China(南开大学先进跨学科研究学院,天津,中国)
On Aligning Hierarchical Standardized Embedding for Audio-visual Generalized Zero-shot Learning
面向音视频广义零样本学习的层次化标准化嵌入对齐
Zihan Zhang, Jie Hong, Siyuan Fan, Yanghao Zhou, Pengfei Fang
机构
*
Southeast University(东南大学)
;
The University of Hong Kong(香港大学)
;
Beijing Institute of Technology(北京理工大学)
;
Key Laboratory of New Generation Artificial Intelligence Technology and Its Interdisciplinary Applications (Southeast University), Ministry of Education(新一代人工智能技术及其跨学科应用重点实验室(东南大学),教育部)
;
School of Computer Science and Engineering, Southeast University(东南大学计算机科学与工程学院)
Cross-modal Consistency Guidance for Robust Emotion Control in Auto-Regressive TTS Models
跨模态一致性引导用于自动回归TTS模型中的鲁棒情绪控制
Yizhou Peng, Yukun Ma, Chong Zhang, Yi-Wen Chao, Chongjia Ni, Bin Ma, Eng Siong Chng
机构
*
Alibaba-NTU Global e-Sustainability CorpLab(阿里-国立大学全球可持续发展公司实验室)
;
Nanyang Technological University(南洋理工大学)
;
College of Computing and Data Science(计算与数据科学学院)
;
Alibaba(阿里)
;
Alibaba Inc.(阿里公司)
MeMo: Attentional Momentum for Real-time Audio-visual Speaker Extraction under Impaired Visual Conditions
MeMo: 视觉受损条件下的实时视听目标说话人提取的注意力动量
Junjie Li, Wenxuan Wu, Shuai Wang, Zexu Pan, Kong Aik Lee, Helen Meng, Haizhou Li
机构
*
Department of Electrical and Electronic Engineering, Faculty of Engineering, The Hong Kong Polytechnic University(电子工程系,工程学院,香港理工大学)
;
Department of Systems Engineering and Engineering Management, The Chinese University of Hong Kong(系统工程与工程管理系,香港中文大学)
;
School of Artificial Intelligence (SAI), The Chinese University of Hong Kong, Shenzhen(人工智能学院(SAI),香港中文大学深圳校区)
;
School of Intelligence Science and Technology, Nanjing University(智能科学与技术学院,南京大学)
;
Tongyi Lab, Alibaba Group, Singapore(通义实验室,阿里巴巴集团,新加坡)
O_O-VC: Synthetic Data-Driven One-to-One Alignment for Any-to-Any Voice Conversion
O_O-VC: 基于合成数据驱动的任意到任意语音转换一一对一对齐
Huu Tuong Tu, Huan Vu, cuong tien nguyen, Dien Hy Ngo, Nguyen Thi Thu Trang
机构
*
VNPT AI, VNPT Group(VNPT AI,VNPT集团)
;
Hanoi University of Science and Technology(河内科学技术大学)
;
Business AI Lab, National Economics University(国家经济大学商业人工智能实验室)