arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

多模态信息融合

面向图像、视频、多传感器和跨模态感知的信息融合,包括 Image Fusion、红外可见光、遥感、医学影像、LiDAR/雷达/相机和音视频融合。

2026-06-03 至 2026-06-03 共收录 10 信号源:cs.CV, eess.IV, eess.SP, cs.RO, cs.MM

1. 自动驾驶多传感器融合 1 篇

2606.02979 2026-06-03 cs.CV cs.AI cs.RO 87%

Towards Compact Autonomous Driving Perception with Balanced Learning and Multi-sensor Fusion

面向紧凑型自动驾驶感知的平衡学习与多传感器融合

Oskar Natan, Jun Miura

机构 * Department of Computer Science and Engineering, Toyohashi University of Technology(计算机科学与工程系,丰田寺大学) Department of Computer Science and Electronics, Gadjah Mada University(计算机科学与电子系,加查马达大学)

专题命中 自动驾驶多传感器融合 :sensor fusion(title,abstract);multi-sensor fusion(title);分类 cs.CV、cs.RO

AI总结 提出一种紧凑的深度多任务学习模型,通过自适应损失加权和中间传感器融合技术,在单次前向传播中同时处理语义分割、深度估计、激光雷达分割和鸟瞰投影,实现高效自动驾驶感知。

Comments This work has been accepted for publication in IEEE Transactions on Intelligent Transportation Systems. https://ieeexplore.ieee.org/document/9712213

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 机器人多传感器融合 5 篇

1211.5060 2026-06-03 eess.SY cs.SY math.OC 78%

On sensor fusion for airborne wind energy systems

关于机载风能系统的传感器融合

Lorenzo Fagiano, Khahn Huynh, Bassam Bamieh, Mustafa Khammash

专题命中 机器人多传感器融合 :sensor fusion(title,abstract)

AI总结 针对机载风能发电机的滤波问题,通过将非线性系统分解为子系统,提出基于运动学定律的传感器融合算法,实现翼体位置、速度和航向的精确重构。

Comments This manuscript is a preprint of a paper accepted for publication on the IEEE Transactions on Control Systems Technology and is subject to IEEE Copyright. The copy of record is available at IEEEXplore library: http://ieeexplore.ieee.org/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03340 2026-06-03 cs.RO 57%

Autonomous Navigation System for Library Service Robot Based on Unitree Go2 Edu

基于 Unitree Go2 Edu 的图书馆服务机器人自主导航系统

Aoduo Li, Haoran Lv, Bingquan Ou, Jianfeng Li, Yingdong Li, Zimeng Li

机构 * Unitree Go2 Edu

专题命中 机器人多传感器融合 :sensor fusion(abstract);分类 cs.RO

AI总结 针对图书馆狭窄通道和动态障碍物环境,提出基于 ROS 2 的四足机器人导航系统,融合 RTAB-Map、AMCL/EKF 和 Nav2 实现高成功率定位与避障,地图误差 3.7 cm。

Comments 6 pages, 5 figures, 4 tables. Accepted by WCCIS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03265 2026-06-03 cs.RO 57%

Wheel-Mounted/GNSS Fusion with AI-Aided Position Updates

基于人工智能辅助位置更新的轮式/GNSS融合定位

Gal Versano, Itzik Klein

机构 * Autonomous Navigation and Sensor Fusion Lab(自主导航与传感器融合实验室) Hatter Department of Marine Technologies(海洋技术系) Charney School of Marine Sciences(海洋科学学院) University of Haifa(海法大学)

专题命中 机器人多传感器融合 :sensor fusion(abstract);分类 cs.RO

AI总结 提出一种混合神经惯性导航框架,结合轮式惯性传感器、强制周期轨迹和神经网络,通过误差状态扩展卡尔曼滤波融合GNSS位置更新,实现定位精度提升约46%。

详情

展开后加载摘要…

URL PDF HTML 收藏
1207.3434 2026-06-03 cs.AI cs.RO cs.SY eess.SY 57%

An Approach to Model Interest for Planetary Rover through Dezert-Smarandache Theory

基于Dezert-Smarandache理论的行星探测器兴趣建模方法

Matteo Ceriotti, Massimiliano Vasile, Giovanni Giardini, Mauro Massari

专题命中 机器人多传感器融合 :information fusion(abstract);分类 cs.RO

AI总结 提出一种通过Dezert-Smarandache理论融合有效载荷和导航信息来量化行星探测器目标兴趣度的方法,实现自主目标重分配与科学目标优选。

Comments Journal Of Aerospace Computing, Information, And Communication Vol. 5, Month 2008

详情

展开后加载摘要…

URL PDF HTML 收藏
1207.4262 2026-06-03 cs.CR cs.DC cs.SY eess.SY 50%

Differentially Private Iterative Synchronous Consensus

差分隐私迭代同步共识

Zhenqi Huang, Sayan Mitra, Geir Dullerud

专题命中 机器人多传感器融合 :sensor fusion(abstract)

AI总结 针对迭代共识问题中保护初始值隐私的需求,提出基于差分隐私的服务端和完全分布式随机机制,并分析隐私与准确性的权衡。

Comments The original manuscript from 18th July was updated with new proofs for Lemmas 3, 6, and 8

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 音视频/视觉语言融合 2 篇

2606.03747 2026-06-03 eess.AS eess.SP 57%

Stable Hybrid Cross-Attention Fusion for Audio-Visual Event Recognition

用于音视频事件识别的稳定混合交叉注意力融合

Parinaz Binandeh Dehaghani, Danilo Pena, A. Pedro Aguiar

专题命中 音视频/视觉语言融合 :hybrid fusion(abstract);分类 eess.SP

AI总结 提出一种结合VideoMAE和AST的混合交叉注意力融合框架,通过FiLM音频条件、双向交叉注意力融合和多模态Transformer编码,在AVE数据集上达到91.74%的验证准确率和83.85%的测试准确率。

Comments 6 pages, 4 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03370 2026-06-03 eess.IV 57%

SMAC: Spatial-Modal Joint Modeling and Adaptive Representation Collapse for Multimodal Object Tracking

SMAC: 空间-模态联合建模与自适应表示崩溃的多模态目标跟踪

Meijing Gao, Qitai Sun, Huanyu Sun, Bingxuan Yang, Bingzhou Sun, Xu Chen, Yonghao Yan, Yuxuan Yang

专题命中 音视频/视觉语言融合 :multimodal fusion(abstract);分类 eess.IV

AI总结 针对复杂光照下多模态多目标跟踪中空间与模态特征联合建模不足及固定融合策略适应性有限的问题,提出基于空间-模态卷积融合和蒸馏提示的多模态跟踪框架,通过解耦3D卷积、幅相分解和表示崩溃网络实现自适应融合,在UniRTL数据集上取得领先性能。

Comments 12 pages, 16 figures. Code and pretrained models are available at https://github.com/QitaiSun/SMAC

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 融合架构与评测 2 篇

2606.02659 2026-06-03 cs.LG cs.AI 50%

CL-DMDF:Dynamic Multimodal Data Fusion Model Based on Contrastive Learning

CL-DMDF:基于对比学习的动态多模态数据融合模型

Dong Li, Lingling Zhang, Binghao Han, Linlin Ding, Yue Kou

机构 * Tsinghua University(清华大学)

专题命中 融合架构与评测 :multimodal fusion(abstract)

AI总结 针对多模态数据融合中模态缺失和局部交互忽视全局互补线索的问题,提出基于对比学习的动态多模态数据融合模型(CL-DMDF),通过跨特征和模态维度的注意力机制、实体质心对比学习模块和自适应融合模块,提升动态融合的效率和准确性。

Comments 9 pages, 5 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27938 2026-06-03 cs.HC 50%

Appraisal Dimensions Generalise Better than Emotion Labels for Cross-Age Affect Recognition in AI-Assisted Healthcare

评估维度在AI辅助医疗中跨年龄情感识别比情感标签更具泛化性

Hippolyte Fournier, Safaa Azzakhnini, Sina Alisamir, Isabella Zsoldos, Eléonore Trân, Gérard Bailly, Frédéric Elisei, Béatrice Bouchot, Brice Varini, Patrick Constant, Joan Fruitet, Franck Tarpin-Bernard, Solange Rossato, François Portet, Olivier Koenig, Hanna Chainay, Fabien Ringeval

专题命中 融合架构与评测 :multimodal fusion(abstract)

AI总结 本研究通过比较基于评估维度和情感标签的多模态模型在老年和青年群体上的表现,发现评估维度在跨年龄情感识别中具有更好的泛化能力和预测稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏