Intelligent Healthcare Imaging Platform: A VLM-Based Framework for Automated Medical Image Analysis and Clinical Report Generation
智能医疗影像平台:基于视觉语言模型的自动化医学图像分析与临床报告生成框架
Samer Al-Hamadani
机构
*
Automated Manufacturing Department/Al-Khwarizmi College of Engineering/ University of Baghdad/Gilgamesh University(自动化制造部门/阿尔·卡瓦尔齐米工程学院/巴格达大学/吉尔伽美什大学)
TTL: Test-time Textual Learning for OOD Detection with Pretrained Vision-Language Models
TTL: 用于基于预训练视觉-语言模型的分布外检测的测试时文本学习
Jinlun Ye, Jiang Liao, Runhe Lai, Xinhua Lu, Jiaxin Zhuang, Zhiyong Gan, Ruixuan Wang
机构
*
Sun Yat-sen University(中山大学)
;
China United Network Communications Corporation Limited Guangdong Branch(中国联合网络通信集团有限公司广东分公司)
;
Peng Cheng Laboratory(鹏城实验室)
;
Hong Kong University of Science and Technology(香港科技大学)
;
Key Laboratory of Machine Intelligence and Advanced Computing, MOE(教育部机器智能与高级计算重点实验室)
机构
*
College of Computer Science and Artificial Intelligence, Fudan University(复旦大学计算机科学与人工智能学院)
;
Huazhong University of Science and Technology(华中科技大学)
;
The University of Hong Kong(香港大学)
;
ByteDance Seed(字节跳动种子)
;
Institute of Trustworthy Embodied AI, Fudan University(复旦大学可信具身人工智能研究院)
;
Shanghai Key Laboratory of Multimodal Embodied AI(上海多模态具身人工智能重点实验室)
Teaching Language Models Mechanistic Explainability Through MechSMILES
通过MechSMILES教会语言模型机制性可解释性
Théo A. Neukomm, Zlatko Jončev, Philippe Schwaller
机构
*
Laboratory of Artificial Chemical Intelligence (LIAC), Institut des Sciences et Ingénierie Chimiques, Ecole Polytechnique Fédérale de Lausanne (EPFL), Lausanne 1015, Switzerland(人工化学智能实验室(LIAC)、化学与工程学院、瑞士联邦理工学院(EPFL)、拉沃斯纳1015号)
机构
*
AMAP, Alibaba Group(阿里集团AMAP)
;
University of California at Merced(加州大学默塞德分校)
;
University of Queensland(昆士兰大学)
;
Case Western Reserve University(凯斯西储大学)
专题命中
视觉定位与Grounding
:multimodal large language model(abstract);分类 cs.CV
Is this chart lying to me? Automating the detection of misleading visualizations
这张图表在欺骗我吗?自动化检测误导性可视化
Jonathan Tonglet, Jan Zimny, Tinne Tuytelaars, Iryna Gurevych
机构
*
Ubiquitous Knowledge Processing Lab (UKP Lab), Department of Computer Science, TU Darmstadt and National Research Center for Applied Cybersecurity ATHENE(普遍知识处理实验室(UKP实验室)、计算机科学系、图腾斯大学(TU Darmstadt)及应用网络安全国家研究中心ATHENE)
;
Department of Electrical Engineering, KU Leuven(电子工程系、鲁文大学)
;
Department of Computer Science, KU Leuven(计算机科学系、鲁文大学)
专题命中
文档图表理解
:multimodal large language model(abstract);分类 cs.CV
Mechanisms of Prompt-Induced Hallucination in Vision-Language Models
视觉-语言模型中提示诱导幻觉的机制
William Rudman, Michal Golovanevsky, Dana Arad, Yonatan Belinkov, Ritambhara Singh, Carsten Eickhoff, Kyle Mahowald
机构
*
The University of Texas at Austin(德克萨斯大学奥斯汀分校)
;
Brown University(布朗大学)
;
Technion(技术学院)
;
University of Tübingen(图宾根大学)
;
Harvard University(哈佛大学)
MEDSYN: Benchmarking Multi-EviDence SYNthesis in Complex Clinical Cases for Multimodal Large Language Models
MEDSYN:多证据合成在复杂临床病例中的基准测试用于多模态大语言模型
Boqi Chen, Xudong Liu, Jiachuan Peng, Marianne Frey-Marti, Bang Zheng, Kyle Lam, Lin Li, Jianing Qiu
机构
*
ETH Zurich(苏黎世联邦理工学院)
;
MBZUAI(马克斯·普朗克人工智能研究所)
;
Amazon(亚马逊)
;
University of Oxford(牛津大学)
;
University of Bern(伯尔尼大学)
;
Imperial College London(伦敦帝国理工学院)
;
Peking University(北京大学)
专题命中
幻觉与鲁棒性
:multimodal large language model(title,abstract)
Anthropogenic Regional Adaptation in Multimodal Vision-Language Model
人为区域适应于多模态视觉-语言模型
Samuel Cahyawijaya, Peerat Limkonchotiwat, Tack Hwa Wong, Hitesh Laxmichand Patel, Amit Agarwal, Manuel Antonio Rufino, Carlos Rafael Catalan, Muhammad Reza Qorib, Vicky Feliren, Holy Lovenia, Aye Hninn Khine, Frederikus Hudi, David Anugraha, Alham Fikri Aji, Romrawin Chumpu, Viet-Thanh Pham, Minghan Wang, Mohamed Fazli Imam, Ruochen Zhang, Joseph Marvin Imperial, Khumaisa Nur'aini, Do Xuan Long, Musa Izzanardi Wijanarko, Joel Ruben Antony Moniz, Patrick Amadeus Irawan, Hanif Muhammad Zhafran, Isaiah Flores, Salsabila Zahirah Pranida, Jun Kevin, Jostin Jerico Rosal, Patricia Nicole Monderin, Kun Kerdthaisong, Ahmad Mustafid, My Chiffon Nguyen, Natchapon Jongwiriyanurak, Siva Worajitwannakul, Haochen Li, Adrian Xuan Wei Lim, Bin Wang, Muhammad Ravi Shulthan Habibi, Lynnette Hui Xian Ng, Mithil Bangera, Yeshil Bangera, Priyaranjan Pattnayak, Dun Li Chan, Sherissa Caren Djuniwar, Cho Chan Myei Oo, Hee Ming Shan
机构
*
Cohere
;
SEACrowd
;
AI Singapore
;
Universiti Teknologi PETRONAS
;
Oracle
;
Carnegie Mellon University(卡内基梅隆大学)
;
Monash University, Indonesia(莫纳什大学(印尼))
;
King Mongkut’s University of Technology Thonburi(泰国孔敬大学)
;
Nara Institute of Science and Technology(奈良科学技術大學)
;
Stanford University(斯坦福大学)
;
MBZUAI
;
National University of Singapore(新加坡国立大学)
;
Monash University, Australia(莫纳什大学(澳大利亚))
;
Brown University(布朗大学)
;
University of Bath(巴斯大学)
;
Mila - Quebec AI Institute(蒙特利尔AI研究所)
;
Institut Teknologi Bandung(Bandung 工程技术大学)
;
Ateneo de Manila University(马尼拉亚特内奥大学)
;
Universitas Pelita Harapan(Pelita Harapan 大学)
;
Seoul National University of Science and Technology(首尔科学技术大学)
;
Thammasat University(泰国 Thammasat 大学)
;
Independent(独立)
;
University College London(伦敦大学学院)
;
Nanyang Technological University(南洋理工大学)
;
MiroMind AI
;
University of Indonesia(印度尼西亚大学)
;
University of New Haven(纽黑文大学)
;
INTI International University and Colleges(INTI 国际大学和学院)
;
Binus University(Binus 大学)
;
National University Philippines(菲律宾国家大学)
;
ThoughtFull