CityRiSE: Reasoning Urban Socio-Economic Status in Large Vision-Language Models via Reinforcement Learning
CityRiSE:基于强化学习的大视觉语言模型城市社会经济地位推理框架
Tianhui Liu, Hetian Pang, Xin Zhang, Jie Feng, Pan Hui, Yong Li
机构
*
Information Hub, The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)信息中心)
;
Department of Electronic Engineering, BNRist, Tsinghua University(清华大学电子工程系)
How Good are Foundation Models in Longitudinal MRI Disease Progression Reasoning?
基础模型在纵向MRI疾病进展推理中的表现如何?
Wafa Al Ghallabi, Ritesh Thawkar, Sara Ghaboura, Omkar Thawakar, Numan Saeed, Dana Al Nuaimi, Ajnas Alkatheeri, Salman Khan, Fahad Shahbaz Khan
机构
*
Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)
;
Department of Health Abu Dhabi(阿布扎比卫生部)
;
Fatima College of Health Sciences(法蒂玛健康科学学院)
;
Linköping University(林雪平大学)
How Do VLMs Behave When Blind or Misled? Behavioral Evaluation of VLMs on Scientific Figures
视觉语言模型(VLMs)在失明或被误导时的表现如何?针对科学图表的VLMs行为评估
Paul Osemudiame Oamen, Owusu-Banahene Osei, Ananya Mukherjee, Christian Greisinger, Steffen Eger, Pius Onobhayedo, Wei Zhao
机构
*
University of Aberdeen(阿伯丁大学)
;
International Institute of Information Technology Hyderabad(海德拉巴国际信息技术学院)
;
University of Technology Nuremberg(纽伦堡工业大学)
;
University of Southern California(南加利福尼亚大学)
机构
*
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
Large Language Model Department, Tencent(腾讯大语言模型部)
;
University of Electronic Science and Technology of China(电子科技大学)
;
Hong Kong University of Science and Technology(香港科技大学)
;
Zhongguancun Academy(中关村学院)