Anthropogenic Regional Adaptation in Multimodal Vision-Language Model
人为区域适应于多模态视觉-语言模型
Samuel Cahyawijaya, Peerat Limkonchotiwat, Tack Hwa Wong, Hitesh Laxmichand Patel, Amit Agarwal, Manuel Antonio Rufino, Carlos Rafael Catalan, Muhammad Reza Qorib, Vicky Feliren, Holy Lovenia, Aye Hninn Khine, Frederikus Hudi, David Anugraha, Alham Fikri Aji, Romrawin Chumpu, Viet-Thanh Pham, Minghan Wang, Mohamed Fazli Imam, Ruochen Zhang, Joseph Marvin Imperial, Khumaisa Nur'aini, Do Xuan Long, Musa Izzanardi Wijanarko, Joel Ruben Antony Moniz, Patrick Amadeus Irawan, Hanif Muhammad Zhafran, Isaiah Flores, Salsabila Zahirah Pranida, Jun Kevin, Jostin Jerico Rosal, Patricia Nicole Monderin, Kun Kerdthaisong, Ahmad Mustafid, My Chiffon Nguyen, Natchapon Jongwiriyanurak, Siva Worajitwannakul, Haochen Li, Adrian Xuan Wei Lim, Bin Wang, Muhammad Ravi Shulthan Habibi, Lynnette Hui Xian Ng, Mithil Bangera, Yeshil Bangera, Priyaranjan Pattnayak, Dun Li Chan, Sherissa Caren Djuniwar, Cho Chan Myei Oo, Hee Ming Shan
机构
*
Cohere
;
SEACrowd
;
AI Singapore
;
Universiti Teknologi PETRONAS
;
Oracle
;
Carnegie Mellon University(卡内基梅隆大学)
;
Monash University, Indonesia(莫纳什大学(印尼))
;
King Mongkut’s University of Technology Thonburi(泰国孔敬大学)
;
Nara Institute of Science and Technology(奈良科学技術大學)
;
Stanford University(斯坦福大学)
;
MBZUAI
;
National University of Singapore(新加坡国立大学)
;
Monash University, Australia(莫纳什大学(澳大利亚))
;
Brown University(布朗大学)
;
University of Bath(巴斯大学)
;
Mila - Quebec AI Institute(蒙特利尔AI研究所)
;
Institut Teknologi Bandung(Bandung 工程技术大学)
;
Ateneo de Manila University(马尼拉亚特内奥大学)
;
Universitas Pelita Harapan(Pelita Harapan 大学)
;
Seoul National University of Science and Technology(首尔科学技术大学)
;
Thammasat University(泰国 Thammasat 大学)
;
Independent(独立)
;
University College London(伦敦大学学院)
;
Nanyang Technological University(南洋理工大学)
;
MiroMind AI
;
University of Indonesia(印度尼西亚大学)
;
University of New Haven(纽黑文大学)
;
INTI International University and Colleges(INTI 国际大学和学院)
;
Binus University(Binus 大学)
;
National University Philippines(菲律宾国家大学)
;
ThoughtFull
Automatic Modeling of Social Concepts Evoked by Art Images as Multimodal Frames
艺术图像中引发的社会概念的自动建模作为多模态框架
Delfina Sol Martinez Pandiani, Valentina Presutti
机构
*
Department of Computer Science and Engineering (DISI), University of Bologna, Italy(博洛尼亚大学计算机科学与工程系(DISI))
;
Department of Modern Languages, Literatures and Cultures (LILEC), University of Bologna, Italy(博洛尼亚大学现代语言、文学与文化系(LILEC))
机构
*
College of Computing and Data Science, Nanyang Technological University, Singapore(南洋理工大学计算机与数据科学学院,新加坡)
;
Alibaba-NTU Global e-Sustainability CorpLab (ANGEL)(阿里巴巴-国立大学全球可持续发展公司实验室(ANGEL))
;
Tongyi Lab, Alibaba Group, China(阿里云实验室,阿里巴巴集团,中国)
机构
*
College of Computer Science and Artificial Intelligence, Fudan University, Shanghai, China(复旦大学计算机科学与人工智能学院,上海,中国)
;
Shanghai Key Laboratory of Intelligent Information Processing(上海智能信息处理重点实验室)