LoRA-Based Cascaded Multimodal Fusion for Action Recognition in Medical Training Environments
基于LoRA的级联多模态融合在医学训练环境中的动作识别
专题命中 融合架构与评测 :multimodal fusion(title,abstract);分类 cs.CV
AI总结 研究面向医疗训练环境的动作识别,提出基于LoRA的级联多模态融合框架,结合特定模态适应与顺序融合,无需重新训练组件,在两个数据集上评估,结果显示该策略优于单模态模型且性能有竞争力。