arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

多模态信息融合

面向图像、视频、多传感器和跨模态感知的信息融合,包括 Image Fusion、红外可见光、遥感、医学影像、LiDAR/雷达/相机和音视频融合。

2026-07-15 至 2026-07-15 共收录 1 信号源:cs.CV, eess.IV, eess.SP, cs.RO, cs.MM

1. 机器人多传感器融合 1 篇

2607.12518 2026-07-15 eess.SP 新提交 57%

Cellular Signal Constructed Convolutional Vision Transformer for High Accuracy Positioning

用于高精度定位的蜂窝信号构建卷积视觉Transformer

Junshi Chen, Xuhong Li, Russ Whiton, Fredrik Tufvesson

专题命中 机器人多传感器融合 :sensor fusion(abstract);分类 eess.SP

AI总结 针对复杂蜂窝环境中定位难题,提出混合卷积视觉Transformer(ConViT)架构,整合CNNs局部感受野与Transformer全局注意力,评估多种信号融合策略,经实验验证其性能显著优于基准模型,且有较低参数数量和计算复杂度,还具备可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏