机构
*
Zhejiang University(浙江大学)
;
Fudan University(复旦大学)
;
Soochow University(苏州大学)
;
Shanghai AI Laboratory(上海人工智能实验室)
;
The Chinese University of Hong Kong(香港中文大学)
R1-ShareVL: Incentivizing Reasoning Capability of Multimodal Large Language Models via Share-GRPO
Huanjin Yao, Qixiang Yin, Jingyi Zhang, Min Yang, Yibo Wang, Wenhao Wu, Fei Su, Li Shen, Minghui Qiu, Dacheng Tao, Jiaxing Huang
机构
*
Nanyang Technological University(南洋理工大学)
;
ByteDance(字节跳动)
;
Tsinghua University(清华大学)
;
Beijing University of Posts and Telecommunications(北京邮电大学)
;
The University of Sydney(悉尼大学)
Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding
Trilok Padhi, Ramneet Kaur, Adam D. Cobb, Manoj Acharya, Anirban Roy, Colin Samplawski, Brian Matejek, Alexander M. Berenbeim, Nathaniel D. Bastian, Susmit Jha
机构
*
Georgia State University(佐治亚州立大学)
;
Computer Science Lab, SRI(SRI计算机科学实验室)
;
Army Cyber Institute, United States Military Academy(美国陆军网络学院)
A Multimodal Foundation Model of Spatial Transcriptomics and Histology for Biological Discovery and Clinical Prediction
一种结合空间转录组学和组织学的多模态基础模型用于生物发现和临床预测
Jinxi Xiang, Siyu Hou, Yuchen Li, Ryan Quinton, Xiaoming Zhang, Feyisope Eweje, Xiangde Luo, Yijiang Chen, Zhe Li, Colin Bergstrom, Ted Kim, Sierra Willens, Francesca Maria Olguin, Matthew Abikenari, Andrew Heider, Sanjeeth Rajaram, Joel Neal, Maximilian Diehn, Xiang Zhou, Ruijiang Li
机构
*
Department of Radiation Oncology, Stanford University School of Medicine(斯坦福大学医学院放射肿瘤学系)
;
Department of Statistics and Data Science, Yale University(耶鲁大学统计与数据科学系)
;
Department of Medicine (Oncology), Stanford University School of Medicine(斯坦福大学医学院医学系(肿瘤学))
;
Department of Pathology, Stanford University School of Medicine(斯坦福大学医学院病理学系)
;
Department of Neurosurgery, Stanford University School of Medicine(斯坦福大学医学院神经外科学系)
;
Stanford Institute for Human-Centered Artificial Intelligence(斯坦福大学以人为本人工智能研究所)
;
Perelman School of Medicine at the University of Pennsylvania(宾夕法尼亚大学佩雷尔曼医学院)
专题命中
其他多模态
:multimodal(title);multimodal foundation model(title);分类 cs.AI
机构
*
Korea University(高丽大学)
;
Upstage AI
;
Kyung Hee University(庆熙大学)
;
KAIST(韩国科学技术院)
;
Hanyang University College of Medicine(汉阳大学医学院)
;
AIGEN Sciences
LookWise: Knowing When and Where to Look for Fine-Grained Visual Reasoning in Multimodal Large Language Models
LookWise: 知道何时何地关注多模态大语言模型中的细粒度视觉推理
Yuxiang Shen, Hailong Huang, Zhenkun Gao, Xueheng Li, Man Zhou, Chengjun Xie, Haoxuan Che, Xuanhua He, Jie Zhang
机构
*
Institute of Intelligent Machines, Hefei Institutes of Physical Science, Chinese Academy of Sciences(智能机器研究所,合肥物理科学研究院,中国科学院)
;
University of Science and Technology of China(中国科学技术大学)
;
Zhejiang University(浙江大学)
;
East China Normal University(华东师范大学)
;
The Hong Kong University of Science and Technology(香港科技大学)
Exposing and Mitigating Calibration Biases and Demographic Unfairness in MLLM Few-Shot In-Context Learning for Medical Image Classification
Xing Shen, Justin Szeto, Mingyang Li, Hengguan Huang, Tal Arbel
机构
*
Centre for Intelligent Machines, McGill University, Montreal, Canada(智能机器中心,麦吉尔大学,加拿大)
;
Mila -- Quebec AI Institute, Montreal, Canada(魁北克人工智能研究所)
;
Stanford University, Stanford, USA(斯坦福大学)
;
University of Copenhagen, Copenhagen, Denmark(哥本哈根大学)
机构
*
The Hong Kong Polytechnic University(香港理工大学)
;
Zhejiang University(浙江大学)
;
University of Electronic Science and Technology of China(电子科技大学)
;
Reallm Labs(Reallm 实验室)
;
Amazon(亚马逊)
;
The Hong Kong University of Science and Technology(香港理工大学)