Emotion Across Speech and Faces: Shared Affective Mechanisms in Multimodal Foundation Models
跨语音与面部的情感:多模态基础模型中的共享情感机制
Xiutian Zhao, Luqi Sun, Björn Schuller, Berrak Sisman
机构
*
Center for Language and Speech Processing (CLSP), Johns Hopkins University(约翰霍普金斯大学语言与语音处理中心)
;
Group on Language, Audio & Music (GLAM), Imperial College London(伦敦帝国理工学院语言、音频与音乐组)
Zheng Tang, Shuo Wang, David C. Anastasiu, Ming-Ching Chang, Anuj Sharma, Quan Kong, Munkhjargal Gochoo, Jun-Wei Hsieh, Tomasz Kornuta, Zhedong Zheng, Renran Tian, Judah Goldfeder, Fulgencio Navarro, Yuxing Wang, Yizhou Wang, Sameer Satish Pusegaonkar, Anqi Li, Nalin Dadhich, Ridham Kachhadiya, Dhanishtha Patil, Haoquan Liang, Jiajun Li, Han Zhang, Yilin Zhao, Zaid Pervaiz Bhat, Shuyu Yang, Ashutosh Kumar, Rong Wang, Rafael Martin Nieto, Peter Christiansen, Ahmed Abduljawad, Mohanrasu Shanmugam, Nadeem Shaik, Sujit Biswas, Xunlei Wu, Vidya Murali, Rama Chellappa
机构
*
Santa Clara University(圣克拉拉大学)
;
University at Albany, SUNY(纽约州立大学奥尔巴尼分校)
;
Iowa State University(爱荷华州立大学)
;
Woven by Toyota(丰田编织公司)
;
United Arab Emirates University(阿拉伯联合酋长国大学)
;
National Yang Ming Chiao Tung University(国立阳明交通大学)
;
University of Macau(澳门大学)
;
North Carolina State University(北卡罗来纳州立大学)
;
Columbia University(哥伦比亚大学)
;
Milestone Systems(里程碑系统公司)
;
Xi’an Jiaotong University(西安交通大学)
;
Johns Hopkins University(约翰斯·霍普金斯大学)