PestVL-Net: Enabling Multimodal Pest Learning via Fine-grained Vision-Language Interaction
PestVL-Net: 通过细粒度视觉-语言交互实现多模态害虫学习
Xueheng Li, Tao Hu, Ke Cao, Runsheng Qi, Huixin Zhang, Rui Li, Jie Zhang, Chengjun Xie
机构
*
Institute of Intelligent Machines, Hefei Institutes of Physical Science, Chinese Academy of Sciences(智能机器研究所,合肥物理科学研究院,中国科学院)
;
University of Science and Technology of China(中国科学技术大学)
;
Zhongke Hefei Institute of Technology Innovation Engineering(中科合肥技术创新工程研究院)
Bias-constrained multimodal intelligence for equitable and reliable clinical AI
具有偏见约束的多模态智能用于公平且可靠的临床AI
Cheng Li, Weijian Huang, Jiarun Liu, Hao Yang, Qi Yang, Song Wu, Ye Li, Hairong Zheng, Shanshan Wang
机构
*
Paul C. Lauterbur Research Center for Biomedical Imaging(Paul C. Lauterbur生物医学成像研究中心)
;
Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(深圳先进技术研究院,中国科学院)
;
Pengcheng Laboratory(鹏城实验室)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Department of Radiology, Beijing Chaoyang Hospital, Capital Medical University(首都医科大学北京朝阳医院放射科)
;
Department of Urology, South China Hospital, Medical School, Shenzhen University(深圳大学南方医院泌尿科)
;
Huawei Technologies Co., Ltd.(华为技术有限公司)
Towards Responsible Multimodal Medical Reasoning via Context-Aligned Vision-Language Models
通过上下文对齐的视觉-语言模型实现负责任的多模态医疗推理
Sumra Khan, Sagar Chhabriya, Aizan Zafar, Sheeraz Arif, Amgad Muneer, Anas Zafar, Shaina Raza, Rizwan Qureshi
机构
*
Salim Habib University(萨利姆·哈比卜大学)
;
Institute of Business Administration Sukkur(苏库尔工商管理学院)
;
University of Central Florida(中佛罗里达大学)
;
The University of Texas MD Anderson Cancer Center(德克萨斯大学MD安德森癌症中心)
;
Toronto Metropolitan University(多伦多都会大学)
;
Vector Institute(向量研究所)
机构
*
Hangzhou City University(杭州城市大学)
;
Hong Kong Baptist University(香港浸会大学)
;
Zhejiang University(浙江大学)
;
The First Affiliated Hospital, Zhejiang University School of Medicine(浙江大学医学院附属第一医院)
;
City University of Hong Kong(香港城市大学)
Understanding and Mitigating Hallucinations in Multimodal Chain-of-Thought Models
理解并缓解多模态推理链模型中的幻觉
Ji Ma, Wei Suo, Peng Wang, Yanning Zhang
机构
*
School of Computer Science and Ningbo Institute, Northwestern Polytechnical University, China(西北工业大学计算机学院和宁波研究院)
;
National Engineering Laboratory for Integrated Aero-Space-Ground-Ocean Big Data Application Technology, China(国家空天地海一体化大数据应用技术国家工程实验室)
机构
*
MoE Key Lab of BIPC, University of Science and Technology of China(脑信息处理实验室,中国科学技术大学)
;
Opus AI Research(Opus AI研究院)
;
Southeast University(东南大学)
;
Nanyang Technological University(南洋理工大学)
MARCUS: An agentic, multimodal vision-language model for cardiac diagnosis and management
MARCUS:一种用于心脏诊断和管理的代理式多模态视觉-语言模型
Jack W O'Sullivan, Mohammad Asadi, Lennart Elbe, Akshay Chaudhari, Tahoura Nedaee, Francois Haddad, Michael Salerno, Li Fe-Fei, Ehsan Adeli, Rima Arnaout, Euan A Ashley
机构
*
Division of Cardiology, Department of Medicine, Stanford University(斯坦福大学心脏病学系)
;
Department of Biomedical Data Science, Stanford University(斯坦福大学生物医学数据科学系)
;
Department of Medicine, Radiology, and Pediatrics, UCSF(旧金山大学医学系、放射学与儿科学系)
;
Bakar Institute, UCSF(Bakar研究所,旧金山大学)
;
UCSF–UC Berkeley Joint Program in Computational Precision Health(旧金山大学-伯克利计算精准健康联合计划)
;
Department of Radiology, Stanford University(斯坦福大学放射学系)
;
Department of Psychiatry and Behavioral Sciences, Stanford University(斯坦福大学精神病学与行为科学系)
;
Department of Computer Science, Stanford University(斯坦福大学计算机科学系)
;
Department of Electrical Engineering, Stanford University(斯坦福大学电气工程系)
;
Department of Biology, Stanford University(斯坦福大学生物学系)
Hong Liu, Dong Wei, Qiong Peng, Yawen Huang, Xian Wu, Yefeng Zheng, Liansheng Wang
机构
*
School of Informatics, Xiamen University, Xiamen, China(厦门大学信息学院)
;
National Institute for Data Science in Health and Medicine, Xiamen University(厦门大学健康医学数据科学研究院)
;
Jarvis Research Center, Tencent YouTu Lab, Shenzhen, China(腾讯YouTu实验室 Jarvis研究部)
;
Medical Artificial Intelligence Laboratory, Westlake University, Hangzhou, China(西湖大学医学人工智能实验室)