AV-EMO-Reasoning: Benchmarking Emotional Reasoning Capabilities in Omni-modal LLMS with Audio-visual Cues
AV-EMO-Reasoning: 在具有视听线索的全模态大语言模型中基准测试情感推理能力
Dingkun Zhou, Krish Patel, Ajay Kankipati, Akshaj Gupta, Zeyi Austin Li, Mohul Shukla, Vibhor Narang, Sara Kofman, Zongli Ye, Grace Wang, Xiaoyu Shi, Tingle Li, Guan-Ting Lin, Kan Jen Cheng, Huang-Cheng Chou, Jiachen Lian, Gopala Anumanchipalli
机构
*
UC Berkeley(加州大学伯克利分校)
;
South China University of Technology(华南理工大学)
;
Zhejiang University(浙江大学)
;
National Taiwan University(台湾大学)
;
University of Southern California(美国南加州大学)
ChildVox: A Speech, Audio, and Large Audio-Language Model Benchmark in Understanding and Characterizing Sound across Childhood
ChildVox:理解与表征儿童期声音的语音、音频及大型音频语言模型基准
Tiantian Feng, Anfeng Xu, Xuan Shi, Aditya Kommineni, Shakhrul Iman Siam, Megan Micheletti, Zhonghao Shi, Helen Tager-Flusberg, Mi Zhang, Lynn K. Perry, Catherine Lord, Daniel Messinger, Shrikanth Narayanan
机构
*
University of Southern California(南加州大学)
;
The Ohio State University(俄亥俄州立大学)
;
University of California, Los Angeles(加州大学洛杉矶分校)
;
Harvard University(哈佛大学)
;
Boston University(波士顿大学)
;
University of Miami(迈阿密大学)