From Alignment to Synthesis Contrastive Volumetric Grounding for Text-to-CT Generation
从对齐到合成:用于文本到CT生成的对比体 grounding
Daniele Molino, Camillo Maria Caruso, Filippo Ruffini, Paolo Soda, Valerio Guarrasi
机构
*
Unit of Artificial Intelligence and Computer Systems, Department of Engineering, Università Campus Bio-Medico di Roma(人工智能与计算机系统单位,工程系,罗马生物医学大学)
;
Department of Diagnostics and Intervention, Biomedical Engineering and Radiation Physics, Umeå University(诊断与干预部门,生物医学工程与放射物理学,乌梅拉大学)
机构
*
the Siebel School of Computing and Data Science(塞比尔计算与数据科学学院)
;
the Department of Agricultural and Biological Engineering(农业与生物工程系)
;
National Center for Supercomputing Applications(国家超级计算中心)
专题命中
视觉定位与Grounding
:VLM(summary_cn,abstract);vision language model(abstract);grounding(abstract)
MEDIC-AD: Towards Medical Vision-Language Model's Clinical Intelligence
MEDIC-AD:迈向医疗视觉-语言模型的临床智能
Woohyeon Park, Jaeik Kim, Sunghwan Steve Cho, Pa Hong, Wookyoung Jeong, Yoojin Nam, Namjoon Kim, Ginny Y. Wong, Ka Chun Cheung, Jaeyoung Do
机构
*
AIDAS Laboratory, Seoul National University(首尔大学AIDAS实验室)
;
Samsung Changwon Hospital(三星昌原医院)
;
Samsung Medical Center(三星医疗中心)
;
NVIDIA, Santa Clara, USA(英伟达(美国圣克拉拉))
Grounding Multi-Hop Reasoning in Structural Causal Models via Group Relative Policy Optimization
通过群体相对策略优化在结构因果模型中 grounding 多跳推理
Yunhan Bu, Quan Zhang, Huaping Zhang, Guotong Geng, Chunxiao Gao, Askar Hamdulla, Juan Wang, Qiuchi Li, Baohua Zhang, Shuai Lei, Yunbo Cao, Zhunchen Luo
机构
*
School of Computer Science and Technology, Xinjiang University, Urumqi, China(新疆大学计算机科学与技术学院,乌鲁木齐,中国)
;
Beijing Institute of Technology, Beijing, China(北京理工大学,北京,中国)
;
Military Science Information Research Center, Academy of Military Science, Beijing, China(军事科学院军事科学信息研究中心,北京,中国)
GridVAD: Open-Set Video Anomaly Detection via Spatial Reasoning over Stratified Frame Grids
GridVAD: 通过分层帧网格上的空间推理实现开放集视频异常检测
Mohamed Eltahir, Ahmed O. Ibrahim, Obada Siralkhatim, Tabarak Abdallah, Sondos Mohamed
机构
*
King Abdullah University of Science and Technology (KAUST)(阿卜杜拉国王科技大学)
;
Independent Researcher(独立研究员)
;
National Center for Research (NCR)(国家研究中心)
VLC Fusion: Vision-Language Conditioned Sensor Fusion for Robust Object Detection
VLC Fusion:面向鲁棒目标检测的视觉-语言条件传感器融合
Aditya Taparia, Noel Ngu, Mario Leiva, Joshua Shay Kricheli, John Corcoran, Nathaniel D. Bastian, Gerardo Simari, Paulo Shakarian, Ransalu Senanayake
机构
*
Arizona State University(亚利桑那州立大学)
;
Department of Computer Science and Engineering, Universidad Nacional del Sur and Institute for Computer Science and Engineering(计算机科学与工程系,国家南方大学和计算机科学与工程研究所)
;
U.S. Department of Defense(美国国防部)
;
United States Military Academy(美国军事学院)
;
Syracuse University(雪城大学)