Medical Context Distorts Decisions in Clinical Vision Language Models
医学语境扭曲了临床视觉语言模型的决策
David Restrepo, Ira Ktena, Maria Vakalopoulou, Stergios Christodoulidis, Enzo Ferrante
机构
*
MICS(医学信息学中心)
;
CentraleSupélec - Université Paris-Saclay(中央超导学院 - 巴黎萨克雷大学)
;
Cancer Data Science Unit(癌症数据科学单元)
;
IHU PRISM
;
National Institute in Precision Oncology(精准肿瘤学国家研究所)
;
University Paris-Saclay(巴黎萨克雷大学)
;
CentraleSupelec(中央超导学院)
;
Gustave Roussy(儒勒-维维安-圣拉扎尔医院)
;
INSERM(国家医学研究院)
;
CONICET(阿根廷国家科研与技术创新委员会)
;
Universidad de Buenos Aires(布宜诺斯艾利斯大学)
Speech-Guided Multimodal Learning for Vocal Tract Segmentation in Real-Time MRI
基于语音引导的多模态学习用于实时MRI中的声道分割
Daiqi Liu, Lukas Mulzer, Md Hasan, Nyvenn de Castro, Fangxu Xing, Xingjian Kang, Chengze Ye, Siyuan Mei, Yipeng Sun, Tomás Arias-Vergara, Jana Hutter, Jonghye Woo, Andreas Maier, Paula Andrea Pérez-Toro
机构
*
Harvard Medical School / Massachusetts General Hospital(哈佛医学院/麻省总医院)
;
Institute for Information Processing, Leibniz University Hannover(汉诺威莱布尼茨信息处理研究所)
;
GITA Lab, Facultad de Ingeniería. Universidad de Antioquia UdeA(安提奥基亚大学工程学院GITA实验室)
CommentsPresented at ACAIN 2025 (Advanced Course & Symposium on Artificial Intelligence & Neuroscience), recipient of the Camillo Golgi Best Paper Award
Leveraging Multimodal Self-Consistency Reasoning in Coding Motivational Interviewing for Alcohol Use Reduction
利用多模态自一致性推理进行编码动机访谈以减少酒精使用
Guangzeng Han, James G. Murphy, Benjamin O. Ladd, Xiaolei Huang, Brian Borsari
机构
*
Department of Computer Science, University of Memphis(密苏里大学计算机科学系)
;
Veterans Affairs Health Care System(退伍军人事务医疗系统)
;
Department of Psychiatry and Behavioral Sciences, University of California San Francisco(旧金山大学精神病学与行为科学系)
;
Department of Psychology, University of Memphis(密苏里大学心理学系)
;
Department of Psychology, Washington State University Vancouver(华盛顿州立大学温哥华分校心理学系)
SIREM: Speech-Informed MRI Reconstruction with Learned Sampling
SIREM: 语音引导的MRI重建与学习采样
Md Hasan, Nyvenn Castro, Daiqi Liu, Lukas Mulzer, Jana Hutter, Jonghye Woo, Moritz Zaiss, Andreas Maier, Paula A. Perez-Toro
机构
*
Pattern Recognition Lab, Friedrich-Alexander-Universität Erlangen-Nürnberg(埃森哲-埃尔朗根-纽伦堡大学模式识别实验室)
;
Institute of Radiology, University Hospital Erlangen, Friedrich-Alexander-Universität Erlangen-Nürnberg(埃尔朗根大学医院放射学研究所)
;
Institut für Informationsverarbeitung, Leibniz Universität Hannover(汉诺威莱比锡大学信息处理研究所)
;
Department of Radiology, Harvard Medical School and Massachusetts General Hospital(哈佛医学院放射科和麻省总医院)
Acoustic Interference: A New Paradigm Weaponizing Acoustic Latent Semantic for Universal Jailbreak against Large Audio Language Models
声学干扰:利用声学潜在语义进行通用劫持的新范式,针对大型音频语言模型
Yanyun Wang, Yu Huang, Zi Liang, Xixin Wu, Li Liu
机构
*
The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州))
;
The Hong Kong Polytechnic University(香港理工大学)
;
The Chinese University of Hong Kong(香港中文大学)
CAM-VFD: Cross-Attention Multimodal Video Forgery Detection
CAM-VFD: 跨注意力多模态视频伪造检测
Hoda Osama Elkhodary, Sherin Mostafa Youssef, Marwa Elshenawy, Dalia Sobhy
机构
*
Computer Engineering Department, College of Engineering and Technology, Arab Academy for Science, Technology and Maritime Transport(计算机工程系,工程与技术学院,阿拉伯科学、技术与海运交通学院)
UTOPYA: A Multimodal Deep Learning Framework for Physics-Informed Anomaly Detection and Time-Series Prediction
UTOPYA:一种用于物理信息异常检测和时间序列预测的多模态深度学习框架
Robson W. S. Pessoa, Julien Amblard, Alessandra Russo, Idelfonso B. R. Nogueira
机构
*
Department of Chemical Engineering, Norwegian University of Science and Technology (NTNU)(化学工程系,挪威科学与技术大学)
;
Department of Computing, Imperial College London(计算系,帝国理工学院伦敦分校)
Empowering VLMs for Few-Shot Multimodal Time Series Classification via Tailored Agentic Reasoning
通过定制代理推理增强VLMs在少样本多模态时间序列分类中的能力
Lin Li, Jiawei Huang, Qihao Quan, Dan Li, Boxin Li, Xiao Zhang, Erli Meng, Wenjie Feng, Jian Lou, See-Kiong Ng
机构
*
Sun Yat-sen University(中山大学)
;
Xiaomi Corporation(小米公司)
;
University of Science and Technology of China(中国科学技术大学)
;
National University of Singapore(新加坡国立大学)
Hi-GaTA: Hierarchical Gated Temporal Aggregation Adapter for Surgical Video Report Generation
Hi-GaTA:用于外科视频报告生成的分层门控时间聚合适配器
Kedi Sun, Chaohui Dang, Yue Feng, James Glasbey, Theodoros N. Arvanitis, Le Zhang
机构
*
School of Engineering, College of Engineering and Physical Sciences, University of Birmingham, Birmingham, UK(英国伯明翰大学工程学院)
;
School of Computer Science, University of Birmingham, Birmingham, UK(英国伯明翰大学计算机科学学院)
;
Department of Applied Health Sciences, University of Birmingham, Birmingham, UK(英国伯明翰大学应用健康科学系)