arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

多模态信息融合

面向图像、视频、多传感器和跨模态感知的信息融合,包括 Image Fusion、红外可见光、遥感、医学影像、LiDAR/雷达/相机和音视频融合。

2026-06-01 至 2026-06-01 共收录 1 信号源:cs.CV, eess.IV, eess.SP, cs.RO, cs.MM

1. 机器人多传感器融合 1 篇

2410.15475 2026-06-01 cs.CV 74%

Multimodal Fusion via Self-Consistent Task-Gradient Fields

通过自洽任务梯度场的多模态融合

Jiayu Xiong, Jing Wang, Jun Xue, Wanlong Wang, Jianlong Kwan, Xiaosen Lyu, Zhouqiang Jiang

机构 * Xiamen Key Laboratory of Computer Vision and Pattern Recognition, Huaqiao University, Xiamen, Fujian, China(厦门计算机视觉与模式识别重点实验室,华侨大学,厦门,福建,中国) Huaqiao University, Xiamen, Fujian, China(华侨大学,厦门,福建,中国) Wuhan University, Wuhan, Hubei, China(武汉大学,武汉,湖北,中国) Nakashima Lab, SANKEN, The University of Osaka, Osaka, Japan(Nakashima实验室,SANKEN,大阪大学,大阪,日本)

专题命中 机器人多传感器融合 :multimodal fusion(title);分类 cs.CV

AI总结 提出自洽场自编码器(SCFAE),利用自洽场原理平衡任务学习与特征组织,通过任务损失和重构损失在互补子空间中分离特征,从而鲁棒处理缺失数据和不均匀输入。

Comments ICML 2026 accepted paper

详情

展开后加载摘要…

URL PDF HTML 收藏