Region-Aware Multimodal Large Language Model via SlowFast Tokenization and Pseudo-Mask Guidance for 3D CT Report Generation
区域感知多模态大语言模型:基于慢快标记化与伪掩码引导的3D CT报告生成
Sunggu Kyung, Jinyoung Seo, Hyunseok Lim, Dongyeong Kim, Hyungbin Park, Jimin Sung, Jihyun Kim, Wooyoung Jo, Yoojin Nam, Namkug Kim
机构
*
Department of Convergence Medicine, University of Ulsan College of Medicine, Asan Medical Center, Seoul, Republic of Korea(韩国首尔峨山医疗中心蔚山大学医学院融合医学系)
;
University of Ulsan College of Medicine, Seoul, Republic of Korea(韩国首尔蔚山大学医学院)
;
Department of Radiology and Research Institute of Radiology, University of Ulsan College of Medicine, Asan Medical Center, Seoul, Republic of Korea(韩国首尔峨山医疗中心蔚山大学医学院放射科与放射学研究所)
专题命中
其他VLM
:multimodal large language model(title,abstract);分类 cs.CV
USE: A Unified Self-Ensembling Framework for Test-Time Prompt Tuning
USE:一种用于测试时提示调整的统一自集成框架
Siru Jiang, Jian Liang, Ran He, Tieniu Tan
机构
*
School of Advanced Interdisciplinary Sciences, University of Chinese Academy of Sciences(中国科学院大学先进交叉学科学院)
;
NLPR & MAIS, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所国家智能机器人实验室及模式识别实验室)
;
Nanjing University(南京大学)
机构
*
National Key Laboratory of Human-Machine Hybrid Augmented Intelligence(人机混合增强智能国家级重点实验室)
;
Institute of Artificial Intelligence and Robotics(人工智能与机器人研究院)
;
MiLM Plus
;
Xiaomi Inc(小米公司)
;
Zhongguancun Academy(中关村学院)
;
Beijing, China(北京市)
专题命中
其他VLM
:multimodal large language model(abstract);分类 cs.AI
Towards Realistic Remote Sensing Dataset Distillation with Discriminative Prototype-guided Diffusion
基于判别原型引导扩散的逼真遥感数据集蒸馏研究
Yonghao Xu, Pedram Ghamisi, Qihao Weng
机构
*
Computer Vision and Learning Systems, Department of Electrical Engineering, Linköping University(计算机视觉与学习系统,电气工程系,利厄普大学)
;
Helmholtz-Zentrum Dresden-Rossendorf, Responsible AI Group(海姆霍尔茨·德累斯顿-罗斯托克研究中心,负责任人工智能小组)
;
University of Iceland, Faculty of Electrical and Computer Engineering(冰岛大学,电气与计算机工程学院)
专题命中
其他VLM
:visual language model(abstract);分类 cs.CV