Position, Not Provenance: Separating Reasoning Mediation from Sycophancy in Medical Vision-Language Models
位置,而非来源:在医学视觉-语言模型中分离推理中介与逢迎行为
机构 * IEM Kolkata(印度工程管理学院 Kolkata校区) ; School of UEMK Kolkata(UEMK Kolkata学院) ; Heritage Institute of Technology Kolkata(加尔各答遗产技术学院) ; Indian Institute of Information Technology, Kalyani(卡利亚尼印度信息技术学院)
专题命中 视觉问答 :LLaVA(summary_cn,abstract);vision-language model(title,abstract);分类 cs.CV、cs.LG
AI总结 本研究提出CoT-Mediate框架,结合双臂协议与来源控制干预,在VQA-RAD数据集上评估LLaVA-Med和MedGemma,发现上下文位置而非声明来源是医学VLMs使用生成推理的主要决定因素。