机构
*
College of Computing, City University of Hong Kong(城市大学 computing 学院)
;
School of Data Science and Artificial Intelligence, Chang’an University(长安大学数据科学与人工智能学院)
;
School of Computer Science and Engineering, Ministry of Education Key Laboratory of Information Technology, Guangdong Province Key Laboratory of Information Security Technology, Sun Yat-Sen University(中山大学计算机科学与工程学院)
;
College of Computing and Data Science, Nanyang Technological University(南洋理工大学 computing 与数据科学学院)
;
Artificial Intelligence Lab. (Recod.ai) at the University of Campinas(坎皮纳斯大学人工智能实验室)
机构
*
Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学(深圳))
;
Peng Cheng Laboratory, Shenzhen, China(鹏城实验室)
;
Guangdong Provincial Key Laboratory of Novel Security Intelligence Technologies(广东省新型安全智能技术重点实验室)
;
The Hong Kong Polytechnic University, Hong Kong, China(香港理工大学)
;
Macau University of Science and Technology, Hong Kong, China(澳门科学技术大学)
Modeling and Measuring Redundancy in Multisource Multimodal Data for Autonomous Driving
多源多模态数据中冗余建模与测量用于自动驾驶
Yuhan Zhou, Mehri Sattari, Haihua Chen, Kewei Sha
机构
*
Dept. of Information Science University of North Texas Denton, Texas, USA(信息科学系 诺克斯维尔大学 德顿, 德克萨斯州, 美国)
;
Dept. of Data Science University of North Texas Denton, Texas, USA(数据科学系 诺克斯维尔大学 德顿, 德克萨斯州, 美国)
Longitudinal NSCLC Treatment Progression via Multimodal Generative Models
多模态生成模型用于非小细胞肺癌治疗进展的纵向预测
Massimiliano Mantegna, Elena Mulero Ayllón, Alice Natalina Caragliano, Francesco Di Feola, Claudia Tacconi, Michele Fiore, Edy Ippolito, Carlo Greco, Sara Ramella, Philippe C. Cattin, Paolo Soda, Matteo Tortora, Valerio Guarrasi
机构
*
Unit of Artificial Intelligence and Computer Systems, Department of Engineering, Università Campus Bio-Medico di Roma, Italy(人工智能与计算机系统单位,工程系,罗马大学生物医学学院)
;
Multi-Specialist Clinical Institute for Orthopaedic Trauma Care (COT), Messina, Italy(骨科创伤护理多学科临床研究所(COT),意大利Messina)
;
Department of Diagnostics and Intervention, Radiation Physics, Biomedical Engineering, Umeå University, Sweden(诊断与介入系,放射物理,生物医学工程,乌梅大学,瑞典)
;
Operative Research Unit of Radiation Oncology, Fondazione Policlinico Universitario Campus Bio-Medico, Rome, Italy(放射肿瘤手术研究单位,大学生物医学学院基金会,罗马,意大利)
;
Research Unit of Radiation Oncology, Department of Medicine and Surgery, Università Campus Bio-Medico di Roma, Italy(放射肿瘤研究单位,医学与外科系,罗马大学生物医学学院,意大利)
;
Department of Biomedical Engineering, University of Basel, Allschwil, Switzerland(生物医学工程系,巴塞尔大学,瑞士Allschwil)
;
Department of Naval, Electrical, Electronics and Telecommunications Engineering, University of Genoa, Italy(海军、电气、电子与电信工程系,热那亚大学,意大利)
机构
*
Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所)
;
Peking University(北京大学)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Sun Yat-sen University(中山大学)
;
Baidu Inc.(百度公司)
RuCL: Stratified Rubric-Based Curriculum Learning for Multimodal Large Language Model Reasoning
RuCL:基于分层评分标准的课程学习用于多模态大语言模型推理
Yukun Chen, Jiaming Li, Longze Chen, Ze Gong, Jingpeng Li, Zhen Qin, Hengyu Chang, Ancheng Xu, Zhihao Yang, Hamid Alinejad-Rokny, Qiang Qu, Bo Zheng, Min Yang
机构
*
Shenzhen Institute of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究院)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Alibaba Group(阿里巴巴集团)
;
School of Biomedical Engineering, UNSW Sydney(新南威尔士大学生物医学工程学院)
OSDM-MReg: Multimodal Image Registration based One Step Diffusion Model
OSDM-MReg: 基于一步扩散模型的多模态图像配准
Xiaochen Wei, Weiwei Guo, Wenxian Yu, Feiming Wei, Dongying Li
机构
*
Shanghai Key Laboratory of Intelligent Sensing and Recognition(上海智能感知与识别重点实验室)
;
Shanghai Jiao Tong University(上海交通大学)
;
Center of Digital Innovation(数字创新中心)
Concept-Enhanced Multimodal RAG: Towards Interpretable and Accurate Radiology Report Generation
概念增强的多模态RAG:迈向可解释且准确的放射科报告生成
Marco Salmè, Federico Siciliano, Fabrizio Silvestri, Paolo Soda, Rosa Sicilia, Valerio Guarrasi
机构
*
Department of Engineering(工程系)
;
Research Unit of Artificial Intelligence and Computer Systems(人工智能与计算机系统研究单位)
;
Università Campus Bio-Medico of Roma(罗马大学生物医学校园)
;
Department of Computer, Control and Management Engineering(计算机、控制与管理工程系)
;
Sapienza University of Rome(罗马萨皮恩扎大学)
;
Department of Diagnostics and Intervention, Radiation Physics, Biomedical Engineering(诊断与介入、辐射物理、生物医学工程系)
;
Umeå University(乌梅拉大学)
;
UniCamillus-Saint Camillus International University of Health Sciences(UniCamillus-圣卡米卢斯国际健康科学大学)
Image Can Bring Your Memory Back: A Novel Multi-Modal Guided Attack against Image Generation Model Unlearning
图像能帮你找回记忆:一种新颖的多模态引导攻击对抗图像生成模型去学习
Renyang Liu, Guanlin Li, Tianwei Zhang, See-Kiong Ng
机构
*
Institute of Data Science, National University of Singapore(数据科学研究所,新加坡国立大学)
;
S-Lab, Nanyang Technological University(南洋理工大学S实验室)
;
College of Computing and Data Science, Nanyang Technological University(计算与数据科学学院,南洋理工大学)
Training Multimodal Large Reasoning Models Needs Better Thoughts: A Three-Stage Framework for Long Chain-of-Thought Synthesis and Selection
训练多模态大推理模型需要更优质的思考:一种用于长链式思考合成与选择的三阶段框架
Yizhi Wang, Linan Yue, Min-Ling Zhang
机构
*
School of Computer Science and Engineering(计算机科学与工程学院)
;
Key Laboratory of Computer Network and Information Integration (SEU), Ministry of Education(计算机网络与信息集成重点实验室(SEU))
Image-to-Brain Signal Generation for Visual Prosthesis with CLIP Guided Multimodal Diffusion Models
基于CLIP引导的多模态扩散模型的图像到脑信号生成用于视觉假体
Ganxi Xu, Zhao-Rong Lai, Yuting Tang, Yonghao Song, Guoxu Zhou, Boyu wang, Jian Zhu, Jinyi Long
机构
*
Jinan University, Guangzhou, China
;
Department of Rehabilitation Medicine, The First Affiliated Hospital of Jinan University, Guangzhou, China
;
Western University, Ontario, Canada
;
Guangdong University of Technology, Guangzhou, China
;
Tsinghua University, Beijing, China