arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

多模态信息融合

面向图像、视频、多传感器和跨模态感知的信息融合,包括 Image Fusion、红外可见光、遥感、医学影像、LiDAR/雷达/相机和音视频融合。

2026-05-04 至 2026-05-04 共收录 5 信号源:cs.CV, eess.IV, eess.SP, cs.RO, cs.MM

1. 红外-可见光融合 2 篇

2605.00461 2026-05-04 eess.IV cs.CV 82%

Combined Dictionary Unfolding Network with Gradient-Adaptive Fidelity for Transferable Multi-Source Fusion

结合字典展开网络与梯度自适应保真度的可迁移多源融合

Ge Luo, Jun-Jie Huang, Qi Yu, Tianrui Liu, Ke Liang, Yuming Xiang, Wentao Zhao, Xinwang Liu, Meng Wang

机构 * College of Computer Science and Technology, National University of Defense Technology(国防科技大学计算机科学与技术学院) College of Surveying and Geoinformatics, Tongji University(同济大学测绘与地理信息学院) School of Computer and Information, Hefei University of Technology(合肥工业大学计算机与信息学院)

专题命中 红外-可见光融合 :image fusion(abstract);infrared and visible(abstract);multi-exposure(abstract);medical image fusion(abstract)

AI总结 本文提出CDNet,通过结合字典学习的共同-特定表示先验,设计轻量级结构约束联合展开架构,提升多源图像融合效率与性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.10668 2026-05-04 physics.optics cond-mat.mes-hall 50%

Plasmonic Nanoparticle-in-nanoslit Antenna as Independently Tunable Dual-Resonant Systems for Efficient Frequency Upconversion

等离子体纳米粒子-纳米沟槽天线作为独立可调双共振系统,用于高效频率上转换

Huatian Hu, Zhiwei Hu, Christophe Galland, Wen Chen

专题命中 红外-可见光融合 :infrared and visible(abstract)

AI总结 本文研究了等离子体纳米粒子-纳米沟槽天线的双共振特性,通过独立调节中红外和可见光共振,提升非线性过程效率,发现新的共振模式以增强上转换效率。

Comments 29 pages, 5 figures, v2

Journal ref Advanced Optical Materials (2025) 13, 29, e01674

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 多聚焦/多曝光融合 1 篇

2511.12895 2026-05-04 cs.CV 57%

High Dynamic Range 3D Gaussian Splatting via Luminance-Chromaticity Decomposition

高动态范围3D高斯散射 via 光亮度-色度分解

Kaixuan Zhang, Minxian Li, Mingwu Ren, Jiankang Deng, Xiatian Zhu

机构 * Nanjing University of Science and Technology(南京理工大学) Imperial College London(伦敦帝国理工学院) University of Surrey(萨里大学)

专题命中 多聚焦/多曝光融合 :multi-exposure(abstract);分类 cs.CV

AI总结 本文提出基于光亮度-色度分解的3D高斯散射方法,通过解耦亮度与色度参数,提升学习灵活性,实现更高效的高动态范围3D重建。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 遥感融合与全色锐化 1 篇

2605.00156 2026-05-04 cs.MM cs.CR 57%

RoboKA: KAN Informed Multimodal Learning for RoboCall Surveillance System

RoboKA:基于KAN的多模态学习用于RoboCall监控系统

Nitin Choudhury, Nikhil Kumar, Aditya Kumar Sinha, Abhijeet Anand, Hossein Salemi, Orchid Chetia Phukan, Hemant Purohit, Arun Balaji Buduru

专题命中 遥感融合与全色锐化 :multimodal fusion(abstract);分类 cs.MM

AI总结 本文提出RoboKA,一种基于KAN的多模态融合框架,用于建模音频和语言线索之间的非线性交互,以提高RoboCall监控的召回率和F1分数。

Comments Accepted to the International Conference on Multimedia & Expo (ICME) 2026, 7th International Workshop on Surveillance Data Processing

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 融合架构与评测 1 篇

2604.04465 2026-05-04 cs.AI 71%

The Topology of Multimodal Fusion: Why Current Architectures Fail at Creative Cognition

多模态融合的拓扑学:为何当前架构在创造性认知上失败

Xiujiang Tan

机构 * Guangzhou Academy of Fine Arts(广州美术学院)

专题命中 融合架构与评测 :multimodal fusion(title)

AI总结 本文指出当前多模态AI架构存在拓扑限制而非参数限制,通过哲学、认知科学和数学三个支柱提出多模态融合的拓扑学框架,提出UOO实现、ANALOGY-MM基准和META-TOP三阶基准,通过实验路线验证拓扑同构性。

Comments Expanded 11 technical improvements; 5 reference corrections; Appendix B pseudocode added. ~43 pages, 5 figures. Chinese philosophical terms romanized. Companion monograph available separately

详情

展开后加载摘要…

URL PDF HTML 收藏