Patho-R1: A Multimodal Reinforcement Learning-Based Pathology Expert Reasoner
Patho-R1: 基于多模态强化学习的病理专家推理器
机构 * Department of Pathology, West China Hospital, Sichuan University(四川大学华西医院病理科部门) ; Institute of Clinical Pathology, West China Hospital, Sichuan University(四川大学华西医院临床病理科研究所) ; University of Toronto(多伦多大学) ; Business School, Sichuan University(四川大学商学院) ; Department of Pathology, Shengjing Hospital of China Medical University(中国医科大学盛京医院病理科部门)
专题命中 多模态训练与对齐 :multimodal(title,abstract);cross-modal(abstract);image-text(abstract);分类 cs.CV、cs.AI
AI总结 本文提出Patho-R1,通过构建高质量推理导向数据集,结合三阶段训练流程提升病理推理能力,实现跨模态任务的鲁棒性能。
Journal ref Proceedings of the AAAI Conference on Artificial Intelligence, 40(33): 28418-28426, 2026