arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

多模态信息融合

面向图像、视频、多传感器和跨模态感知的信息融合,包括 Image Fusion、红外可见光、遥感、医学影像、LiDAR/雷达/相机和音视频融合。

共收录 516 信号源:cs.CV, eess.IV, eess.SP, cs.RO, cs.MM

1. 通用Image Fusion 516 篇

2604.05742 2026-04-08 cs.CV 79%

ASSR-Net: Anisotropic Structure-Aware and Spectrally Recalibrated Network for Hyperspectral Image Fusion

ASSR-Net:一种用于超分辨率图像融合的各向异性结构感知与频谱重校准网络

Qiya Song, Hongzhi Zhou, Lishan Tan, Renwei Dian, Shutao Li

机构 * School of Information Science and Engineering, Hunan Normal University(湖南师范大学信息科学与工程学院) School of Robotics, Hunan University(湖南大学机器人学院)

专题命中 通用Image Fusion :image fusion(title,abstract);分类 cs.CV

AI总结 ASSR-Net通过两阶段融合策略,解决超分辨率图像融合中各向异性结构重建不足和频谱失真问题,提升空间细节和频谱一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01579 2026-04-03 cs.CV cs.AI 79%

Harmonized Tabular-Image Fusion via Gradient-Aligned Alternating Learning

通过梯度对齐交替学习实现表-图像融合

Longfei Huang, Yang Yang

机构 * Nanjing University of Science and Technology(南京理工大学)

专题命中 通用Image Fusion :image fusion(title,abstract);分类 cs.CV

AI总结 本文提出GAAL方法,通过对齐模态梯度解决多模态表-图像融合中的梯度冲突问题,提升融合性能。

Comments ICME 26

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24379 2026-04-03 cs.CV 79%

A Luminance-Aware Multi-Scale Network for Polarization Image Fusion with a Multi-Scene Dataset

一种考虑亮度的多尺度网络用于极化图像融合与多场景数据集

Zhuangfan Huang, Xiaosong Li, Gao Wang, Tao Ye, Haishu Tan, Huafeng Li

机构 * Guangdong-HongKong-Macao Joint Laboratory for Intelligent Micro-Nano Optoelectronic Technology, School of Physics and Optoelectronic Engineering, Foshan University(广东-香港-澳门智能微纳光电子技术联合实验室,物理与光电工程学院,佛山大学) State Key Laboratory of Dynamic Measurement Technology, North University of China(动态测试技术国家重点实验室,中北大学) School of Information Engineering and Automation, Kunming University of Science and Technology(信息工程与自动化学院,昆明理工大学)

专题命中 通用Image Fusion :image fusion(title,abstract);分类 cs.CV

AI总结 本文提出考虑亮度的多尺度网络,通过多尺度空间权重矩阵和全局-局部特征融合机制,提升极化图像融合在复杂光照环境下的性能,使用多场景数据集验证了方法的优越性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13157 2026-03-24 cs.CV cs.AI 79%

Intrinsic Image Fusion for Multi-View 3D Material Reconstruction

多视角3D材质重建的内在图像融合

Peter Kocsis, Lukas Höllein, Matthias Nießner

机构 * Technical University of Munich(慕尼黑技术大学)

专题命中 通用Image Fusion :image fusion(title,abstract);分类 cs.CV

AI总结 本文提出内在图像融合方法,通过多视角图像重建高质量物理材质。引入单视角先验约束优化过程,利用扩散基材质估计器生成多个不一致候选分解,并通过鲁棒优化框架融合最一致的预测,最终优化低维参数,提升材质分离质量。

Comments Project page: https://peter-kocsis.github.io/IntrinsicImageFusion/ Video: https://www.youtube.com/watch?v=-Vs3tR1Xl7k

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.02090 2026-03-17 cs.CV 79%

All-weather Multi-Modality Image Fusion: Unified Framework and 100k Benchmark

全天候多模态图像融合:统一框架与10万基准

Xilai Li, Wuyang Liu, Xiaosong Li, Fuqiang Zhou, Huafeng Li, Feiping Nie

机构 * Guangdong-HongKong-Macao Joint Laboratory for Intelligent MicroNano Optoelectronic Technology(粤港澳联合智能微纳光电子技术实验室) School of Physics and Optoelectronic Engineering, Foshan University(佛山大学物理与光电工程学院) Guangdong Provincial Key Laboratory of Industrial Intelligent Inspection Technology(广东省工业智能检测技术重点实验室) School of Instrumentation and Optoelectronic Engineering, Beihang University(北京航空航天大学仪器与光电工程学院) School of Information Engineering and Automation, Kunming University of Science and Technology(昆明理工大学信息工程与自动化学院) School of Artificial Intelligence, Optics and Electronics (i0PEN), School of Computer Science, Northwestern Polytechnical University(人工智能、光学与电子学院(i0PEN),西北工业大学计算机学院)

专题命中 通用Image Fusion :image fusion(title,abstract);分类 cs.CV

AI总结 本文提出统一的全天候多模态图像融合框架,通过联合特征融合与恢复提升关键场景信息表征,构建10万张图像对的多模态数据集,实验证明在真实和合成场景中图像融合及下游任务表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.01212 2026-02-10 cs.CV 79%

TSJNet: A Multi-modality Target and Semantic Awareness Joint-driven Image Fusion Network

TSJNet: 一种多模态目标和语义意识联合驱动的图像融合网络

Yuchan Jie, Yushen Xu, Xiaosong Li, Huafeng Li, Haishu Tan, Feiping Nie

机构 * School of Physics and Optoelectronic Engineering, Foshan University(物理与光电工程学院,佛山大学) School of Information Engineering and Automation, Kunming University of Science and Technology(信息工程与自动化学院,昆明理工大学) School of Artificial Intelligence, Optics and Electronics (i0PEN), School of Computer Science, Northwestern Polytechnical University(人工智能、光学与电子学院(i0PEN),计算机科学学院,西北工业大学)

专题命中 通用Image Fusion :image fusion(title);multimodal fusion(abstract);分类 cs.CV

AI总结 TSJNet通过联合驱动的多模态图像融合网络提升目标检测与语义分割的性能,实现7.97%和10.88%的精度提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16381 2026-01-26 cs.CV 79%

VTFusion: A Vision-Text Multimodal Fusion Network for Few-Shot Anomaly Detection

VTFusion: 一种面向少样本异常检测的视觉-文本多模态融合网络

Yuxin Jiang, Yunkang Cao, Yuqi Cheng, Yiheng Zhang, Weiming Shen

专题命中 通用Image Fusion :multimodal fusion(title,abstract);分类 cs.CV

AI总结 VTFusion通过自适应特征提取和多模态融合模块,提升少样本异常检测性能,实现96.8%的AUROC。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13052 2026-01-21 cs.CV 79%

GridNet-HD: A High-Resolution Multi-Modal Dataset for LiDAR-Image Fusion on Power Line Infrastructure

GridNet-HD: 一种高分辨率多模态数据集,用于电力线路基础设施的LiDAR-图像融合

Antoine Carreaud, Shanci Li, Malo De Lacour, Digre Frinde, Jan Skaloud, Adrien Gressin

专题命中 通用Image Fusion :image fusion(title);multi-modal fusion(abstract);分类 cs.CV

AI总结 GridNet-HD是一个高分辨率多模态数据集,用于电力线路基础设施的LiDAR-图像融合,通过融合高密度LiDAR和高分辨率影像提升3D语义分割性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12432 2025-11-18 cs.CV 79%

Text-Guided Channel Perturbation and Pretrained Knowledge Integration for Unified Multi-Modality Image Fusion

Xilai Li, Xiaosong Li, Weijun Jiang

机构 * Xilai Li, Xiaosong Li, Weijun Jiang(作者)

专题命中 通用Image Fusion :image fusion(title,abstract);分类 cs.CV

Comments Accepted at AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08272 2025-11-14 cs.CV 79%

MAUGIF: Mechanism-Aware Unsupervised General Image Fusion via Dual Cross-Image Autoencoders

Kunjing Yang, Zhiwei Wang, Minru Bai

机构 * School of Mathematics, Hunan University(湖南大学数学学院) College of Information Engineering, Zhejiang University of Technology(浙江工业大学信息工程学院) Department of Electrical and Electronic Engineering, The University of Hong Kong(香港大学电子与电气工程系)

专题命中 通用Image Fusion :image fusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23356 2025-10-27 cs.CV 79%

ControlFusion: A Controllable Image Fusion Framework with Language-Vision Degradation Prompts

Linfeng Tang, Yeda Wang, Zhanchuan Cai, Junjun Jiang, Jiayi Ma

机构 * Electronic Information School, Wuhan University(武汉大学电子信息学院) School of Computer Science and Engineering, Macau University of Science and Technology(澳门科学技术大学计算机科学与工程学院) Faculty of Computing, Harbin Institute of Technology(哈尔滨工业大学计算机学院)

专题命中 通用Image Fusion :image fusion(title,abstract);分类 cs.CV

Comments Accepted to NeurIPS 2025. The code is available at https://github.com/Linfeng-Tang/ControlFusion

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15589 2025-10-20 cs.CV stat.CO 79%

Standardization for improved Spatio-Temporal Image Fusion

Harkaitz Goyena, Peter M. Atkinson, Unai Pérez-Goya, M. Dolores Ugarte

机构 * Department of Statistics, Computer Science and Mathematics(统计、计算机科学与数学系) Public University of Navarre(纳瓦拉公共大学) InaMat$^2$ Institute(InaMat²研究所) Lancaster Environment Centre(兰卡斯特环境中心)

专题命中 通用Image Fusion :image fusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16549 2025-09-25 cs.CV 79%

Efficient Rectified Flow for Image Fusion

Zirui Wang, Jiayi Zhang, Tianwei Guan, Yuhan Zhou, Xingyuan Li, Minjing Dong, Jinyuan Liu

机构 * City University of Hong Kong(香港城市大学) Dalian University of Technology(大连理工大学) Chinese University of Hong Kong(香港中文大学) Zhejiang University(浙江大学)

专题命中 通用Image Fusion :image fusion(title,abstract);分类 cs.CV

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16881 2025-08-26 cs.CV 79%

AWM-Fuse: Multi-Modality Image Fusion for Adverse Weather via Global and Local Text Perception

Xilai Li, Huichun Liu, Xiaosong Li, Tao Ye, Zhenyu Kuang, Huafeng Li

机构 * Guangdong-HongKong-Macao Joint Laboratory for Intelligent MicroNano Optoelectronic Technology(粤港澳联合智能微纳光电子技术联合实验室) Foshan University(佛山大学) School of Mechanical Electronic and Information Engineering(机械电子信息工程学院) China University of Mining and Technology(中国矿业大学) School of Information Engineering and Automation(信息工程与自动化学院)

专题命中 通用Image Fusion :image fusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.05164 2025-08-01 cs.CV 79%

Balancing Task-invariant Interaction and Task-specific Adaptation for Unified Image Fusion

Xingyu Hu, Junjun Jiang, Chenyang Wang, Kui Jiang, Xianming Liu, Jiayi Ma

机构 * Harbin Institute of Technology(哈尔滨理工大学) Wuhan University(武汉大学)

专题命中 通用Image Fusion :image fusion(title,abstract);分类 cs.CV

Comments Accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21971 2025-07-30 cs.CV 79%

EIFNet: Leveraging Event-Image Fusion for Robust Semantic Segmentation

Zhijiang Li, Haoran He

机构 * Beijing University of Posts and Telecommunications(北京邮电大学)

专题命中 通用Image Fusion :image fusion(title);multi-modal fusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19948 2025-07-29 cs.CV 79%

UniCT Depth: Event-Image Fusion Based Monocular Depth Estimation with Convolution-Compensated ViT Dual SA Block

Luoxi Jing, Dianxi Shi, Zhe Liu, Songchang Jin, Chunping Qiu, Ziteng Qiao, Yuxian Li, Jianqiang Xia

机构 * School of Computer Science, Peking University(北京大学计算机科学系) Intelligent Game and Decision Lab (IGDL)(智能游戏与决策实验室) College of Computer, National University of Defense Technology(国防科技大学计算机学院) School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学系)

专题命中 通用Image Fusion :image fusion(title,abstract);分类 cs.CV

Comments Accepted by IJCAI 2025 (International Joint Conference on Artificial Intelligence)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.07029 2025-05-27 cs.CV 79%

Distilling Textual Priors from LLM to Efficient Image Fusion

Ran Zhang, Xuanhua He, Ke Cao, Liu Liu, Li Zhang, Man Zhou, Jie Zhang

机构 * Hefei University of Technology(合肥工业大学) University of Science and Technology of China(中国科学技术大学) Hefei Institutes of Physical Science, Chinese Academy of Sciences(中国科学院合肥物质科学研究院)

专题命中 通用Image Fusion :image fusion(title,abstract);分类 cs.CV

Comments Change to TCSVT format

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.09106 2025-04-15 cs.CV 79%

Multi-modal and Multi-view Fundus Image Fusion for Retinopathy Diagnosis via Multi-scale Cross-attention and Shifted Window Self-attention

Yonghao Huang, Leiting Chen, Chuan Zhou

专题命中 通用Image Fusion :image fusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.08291 2025-04-14 cs.CV 79%

DreamFuse: Adaptive Image Fusion with Diffusion Transformer

Junjia Huang, Pengxiang Yan, Jiyang Liu, Jie Wu, Zhao Wang, Yitong Wang, Liang Lin, Guanbin Li

专题命中 通用Image Fusion :image fusion(title,abstract);分类 cs.CV

Comments under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.05795 2025-04-10 cs.CV 79%

Robust Fusion Controller: Degradation-aware Image Fusion with Fine-grained Language Instructions

Hao Zhang, Yanping Zha, Qingwei Zhuang, Zhenfeng Shao, Jiayi Ma

专题命中 通用Image Fusion :image fusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23355 2025-04-01 cs.CV 79%

DSPFusion: Image Fusion via Degradation and Semantic Dual-Prior Guidance

Linfeng Tang, Chunyu Li, Guoqing Wang, Yixuan Yuan, Jiayi Ma

专题命中 通用Image Fusion :image fusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18627 2025-03-25 cs.CV cs.AI 79%

Dig2DIG: Dig into Diffusion Information Gains for Image Fusion

Bing Cao, Baoshuo Cai, Changqing Zhang, Qinghua Hu

专题命中 通用Image Fusion :image fusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.14944 2025-03-20 cs.CV 79%

MMAIF: Multi-task and Multi-degradation All-in-One for Image Fusion with Language Guidance

Zihan Cao, Yu Zhong, Ziqi Wang, Liang-Jian Deng

专题命中 通用Image Fusion :image fusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.14774 2025-03-20 cs.CV 79%

Revisiting Image Fusion for Multi-Illuminant White-Balance Correction

David Serrano-Lozano, Aditya Arora, Luis Herranz, Konstantinos G. Derpanis, Michael S. Brown, Javier Vazquez-Corral

专题命中 通用Image Fusion :image fusion(title,abstract);分类 cs.CV

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.02784 2025-03-19 cs.CV 79%

DDF: A Novel Dual-Domain Image Fusion Strategy for Remote Sensing Image Semantic Segmentation with Unsupervised Domain Adaptation

Lingyan Ran, Lushuang Wang, Tao Zhuo, Yinghui Xing

专题命中 通用Image Fusion :image fusion(title,abstract);分类 cs.CV

Comments Accepted to IEEE Transactions on Geoscience and Remote Sensing

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15694 2025-02-28 cs.IR cs.CV cs.LG 79%

Image Fusion for Cross-Domain Sequential Recommendation

Wangyu Wu, Siqi Song, Xianglin Qiu, Xiaowei Huang, Fei Ma, Jimin Xiao

专题命中 通用Image Fusion :image fusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.18124 2024-12-25 cs.CV 79%

VisionLLM-based Multimodal Fusion Network for Glottic Carcinoma Early Detection

Zhaohui Jin, Yi Shuai, Yongcheng Li, Lingcong Cai, Yun Li, Huifen Liu, Xiaomao Fan

专题命中 通用Image Fusion :multimodal fusion(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.02840 2024-11-06 cs.CV 79%

Test-Time Dynamic Image Fusion

Bing Cao, Yinan Xia, Yi Ding, Changqing Zhang, Qinghua Hu

专题命中 通用Image Fusion :image fusion(title,abstract);分类 cs.CV

Comments Accepted by NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.12274 2024-10-17 cs.CV 79%

Fusion from Decomposition: A Self-Supervised Approach for Image Fusion and Beyond

Pengwei Liang, Junjun Jiang, Qing Ma, Xianming Liu, Jiayi Ma

专题命中 通用Image Fusion :image fusion(title,abstract);分类 cs.CV

Comments 18page

详情

展开后加载摘要…

URL PDF HTML 收藏