Towards Clinically Faithful Medical Image Captioning via Enhanced Vision-Language Alignment
基于增强型视觉-语言对齐的临床可信医学图像描述生成研究
机构 * Chung-Ang University(中央大学)
专题命中 安全评测 :alignment(title,abstract);trustworthy(abstract);分类 cs.CL
AI总结 本研究针对医学图像描述生成的临床可信性问题,提出分离训练与推理对齐的框架,结合多编码器、辅助学习及MedPAIR-SCST方法,通过选择与强化学习对齐提升临床一致性,在数据受限场景下改善医学图像描述的可信度。
Comments 10 pages, 2 figures, 7 tables. Preprint submitted to IEEE for possible publication