RVLM: Recursive Vision-Language Models with Adaptive Depth
具有自适应深度的递归视觉-语言模型
机构 * Department of Computer Science(计算机科学系) ; University of Wollongong in Dubai(迪拜沃林戈大学) ; Dubai Knowledge Park(迪拜知识园区) ; Mohammed Bin Rashid School of Government(穆罕默德·本·拉希德政府学院)
专题命中 医疗多模态 :medical AI(abstract);clinical AI(abstract);MRI(abstract);分类 cs.CV
AI总结 本文提出RVLM,通过迭代生成-执行循环和自适应迭代深度控制器,解决医学AI系统在可解释性和推理深度上的限制,实验证明其在脑部MRI和胸部X光中的有效性。