Deformba: Vision State Space Model with Adaptive State Fusion
Deformba:具有自适应状态融合的视觉状态空间模型
机构 * Department of Computer Science, Georgia State University(佐治亚州立大学计算机科学系) ; University of Tennessee Knoxville(田纳西大学肯纳邦克分校)
专题命中 自动驾驶多传感器融合 :multi-modal fusion(abstract);分类 cs.CV
AI总结 本文提出Deformba,一种能够动态增强空间结构信息并保持状态空间模型线性复杂度的自适应方法,通过多模态融合(如交叉注意力)提升视觉任务的性能,展示了在2D和3D视觉任务中的广泛适用性。
Journal ref Forty-Third International Conference on Machine Learning (ICML 2026)