arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

多模态信息融合

面向图像、视频、多传感器和跨模态感知的信息融合,包括 Image Fusion、红外可见光、遥感、医学影像、LiDAR/雷达/相机和音视频融合。

2026-08-05 至 2026-08-05 共收录 3 信号源:cs.CV, eess.IV, eess.SP, cs.RO, cs.MM

1. 通用Image Fusion 2 篇

2608.03252 2026-08-05 cs.CV 新提交 88%

Clarity Contrast and Similarity Selection for Multi-Focus Image Fusion

用于多聚焦图像融合的清晰度对比与相似性选择

Yicheng Zhang, Haoyou Deng, Zhiqiang Li, Wenti Yin, Nong Sang, Changxin Gao

专题命中 通用Image Fusion :image fusion(title,abstract);multi-focus(title,abstract);分类 cs.CV

AI总结 该研究针对多聚焦图像融合中源图像交互不足的问题,提出CSNet模型,通过CCAM和相似性选择策略实现信息交互,在定量和定性评估中达到当前最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03107 2026-08-05 cs.CV 新提交 74%

A Unified Resolution-Conditioned Framework for Orthogonal Line-Scanning Image Fusion

一种用于正交线扫描图像融合的统一分辨率条件框架

Yiming Gong, Kai Wang

专题命中 通用Image Fusion :image fusion(title);分类 cs.CV

AI总结 针对正交线扫描图像融合,提出基于RELA和FiLM的统一分辨率条件框架,可跨狭缝宽度适配,性能优于现有方法,能平滑泛化到未见过的中间配置。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 音视频/视觉语言融合 1 篇

2608.03475 2026-08-05 cs.MM cs.AI cs.CL 新提交 57%

Adaptive Modality Reliability Diagnosis and Restoration for Robust Multimodal Intent Recognition

用于鲁棒多模态意图识别的自适应模态可靠性诊断与恢复

Suraj Kumar, Mohnish Raj, Soumi Chattopadhayay, Chandranath Adak, Ayan Dutta

专题命中 音视频/视觉语言融合 :multimodal fusion(abstract);分类 cs.MM

AI总结 提出PRIME闭环可靠性引导框架,通过诊断恢复多模态意图识别的不可靠模态,在保持干净数据性能的同时提升了多模态数据各类退化场景下的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏