arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

多模态信息融合

面向图像、视频、多传感器和跨模态感知的信息融合,包括 Image Fusion、红外可见光、遥感、医学影像、LiDAR/雷达/相机和音视频融合。

共收录 4740 信号源:cs.CV, eess.IV, eess.SP, cs.RO, cs.MM

1. 通用Image Fusion 516 篇

2607.02572 2026-07-07 cs.CV cs.AI 新提交 83%

Additive Causal Construction for Transferable and Reconfigurable Cross-System Learning in Multi-Source Image Fusion

多源图像融合中用于可转移和可重构跨系统学习的加性因果构建

Zhizhong Fu, Wei Zhou, Zhaoyang Jiang, Yulong Lin, Yifu Hou, Xiaorong Ding, Qiang Yan, Yifan Chen

机构 * School of Life Science and Technology, University of Electronic Science and Technology of China(电子科技大学生命科学与技术学院) School of Health and Wellbeing, University of Glasgow(格拉斯哥大学健康与幸福学院) Department of Organ Transplantation, Sichuan Provincial People’s Hospital, University of Electronic Science and Technology of China(电子科技大学附属四川省人民医院器官移植科) School of Information and Software Engineering, University of Electronic Science and Technology of China(电子科技大学信息与软件工程学院) Department of Radiology, Huzhou Maternity & Child Health Care Hospital(湖州市妇幼保健院放射科) Hepatological Surgery Department, Huzhou Central Hospital, Fifth School of Clinical Medicine of Zhejiang Chinese Medical University(浙江中医药大学附属湖州中医院第五临床医学院湖州市中心医院肝外科)

专题命中 通用Image Fusion :image fusion(title,abstract);information fusion(abstract);分类 cs.CV

AI总结 针对多源图像融合中跨系统差异和纠缠问题,提出加性因果构建框架,通过干预一致性建立共享因果‘锚’实现因果图可转移,将融合过程形式化为因果构建并量化不确定性确保可重构,改进因果表示学习。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07985 2026-06-09 cs.CV cs.CL 新提交 83%

FMRFusion: Frequency-Aware Multi-View Representation Learning for Heterogeneous Image Fusion

FMRFusion: 面向异质图像融合的频率感知多视图表示学习

Tao Zhoua, Yunlong Liu, Qinghui Chen, Zekai Zhang, Minlong Sun, Changlin Biana, Dagang Li, Wenmin Wang, Jinglin Zhang

机构 * Shandong University(山东大学) Macau University of Science and Technology(澳门科技大学)

专题命中 通用Image Fusion :image fusion(title,abstract);infrared and visible(abstract);分类 cs.CV

AI总结 提出FMRFusion网络,通过多尺度结构感知模块、双线性频率分解和跨视图互补交互,结合流匹配优化,实现红外与可见光图像融合,在夜间场景表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01760 2026-05-22 cs.CV 83%

MagicFuse: Single Image Fusion for Visual and Semantic Reinforcement

MagicFuse: 单图像融合用于视觉与语义增强

Hao Zhang, Yanping Zha, Zizhuo Li, Meiqi Gong, Jiayi Ma

机构 * Electronic Information School, Wuhan University, China(武汉大学电子信息学院) Suzhou Institute of Wuhan University, China(武汉大学苏州研究院) School of Automation, Wuhan University, China(武汉大学自动化学院)

专题命中 通用Image Fusion :image fusion(title,abstract);multi-modal image fusion(abstract);分类 cs.CV

AI总结 本文提出MagicFuse单图像融合框架,通过扩散模型生成跨光谱场景表示,实现视觉与语义的双重约束,实验表明其性能优于多模态融合方法。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06049 2026-05-08 cs.CV 83%

Fusion in Your Way: Aligning Image Fusion with Heterogeneous Demands via Direct Preference Optimization

融合你的方式:通过直接偏好优化对齐图像融合与异质需求

Weijian Su, Songqian Zhang, Yuqi Han, Jian Zhuang, Yongdong Huang, Qiang Zhang

机构 * School of Computer Science and Technology, Dalian University of Technology(大连理工大学计算机科学与技术学院) Key Laboratory of Social Computing and Cognitive Intelligence (Dalian University of Technology), Ministry of Education(社会计算与认知智能重点实验室(大连理工大学),教育部) Institute of Image Processing and Understanding, North Minzu University(北华大学图像处理与理解研究所)

专题命中 通用Image Fusion :image fusion(title,abstract);infrared and visible(abstract);分类 cs.CV

AI总结 本文提出DPOFusion框架,通过整合PALDM和PCLDM实现任务引导和偏好适应的图像融合,解决人类和机器视觉的异质需求问题,提升融合质量和任务导向的迁移能力。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20260 2026-01-29 cs.CV 83%

Reversible Efficient Diffusion for Image Fusion

可逆高效扩散用于图像融合

Xingxin Xu, Bing Cao, DongDong Li, Qinghua Hu, Pengfei Zhu

机构 * School of New Media and Communication, Tianjin University(新媒体与传播学院,天津大学) School of Artificial Intelligence, Tianjin University(人工智能学院,天津大学) Low-Altitude Intelligence Laboratory, Xiong’an National Innovation Center(低空智能实验室,雄安国家创新中心) Xiong’an Guochuang Lantian Technology Co., Ltd.(雄安国创蓝天科技有限公司) National University of Defense Technology(国防科技大学)

专题命中 通用Image Fusion :image fusion(title,abstract);multi-modal image fusion(abstract);分类 cs.CV

AI总结 本文提出可逆高效扩散模型,通过显式监督提升图像融合的生成能力,解决传统扩散模型在融合任务中的细节损失问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10109 2025-11-26 cs.CV 83%

Dream-IF: Dynamic Relative EnhAnceMent for Image Fusion

Dream-IF: 动态相对增强用于图像融合

Xingxin Xu, Bing Cao, Dongdong Li, Qinghua Hu, Pengfei Zhu

专题命中 通用Image Fusion :image fusion(title,abstract);multi-modal image fusion(abstract);分类 cs.CV

AI总结 Dream-IF通过动态相对增强框架提升图像融合质量,结合主导区域信息实现多模态图像的协同增强。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12525 2025-11-18 cs.CV 83%

MdaIF: Robust One-Stop Multi-Degradation-Aware Image Fusion with Language-Driven Semantics

Jing Li, Yifan Wang, Jiafeng Yan, Renlong Zhang, Bin Yang

专题命中 通用Image Fusion :image fusion(title,abstract);infrared and visible(abstract);分类 cs.CV

Comments 10 pages, 7 figures. Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.10080 2025-05-27 cs.CV cs.AI 83%

DAE-Fuse: An Adaptive Discriminative Autoencoder for Multi-Modality Image Fusion

Yuchen Guo, Ruoxiang Xu, Rongcheng Li, Weifeng Su

机构 * Department of Computer Science(计算机科学系) Guangdong Provincial Key Lab of Interdisciplinary Research and Application for Data Science(广东省交叉学科研究与数据科学应用重点实验室) Beijing Normal - Hong Kong Baptist University(北京师范大学-香港 Baptist大学)

专题命中 通用Image Fusion :image fusion(title,abstract);medical image fusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01210 2025-03-26 cs.CV 83%

Every SAM Drop Counts: Embracing Semantic Priors for Multi-Modality Image Fusion and Beyond

Guanyao Wu, Haoyu Liu, Hongming Fu, Yichuan Peng, Jinyuan Liu, Xin Fan, Risheng Liu

专题命中 通用Image Fusion :image fusion(title,abstract);infrared and visible(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.03240 2025-03-25 cs.CV 83%

Task-driven Image Fusion with Learnable Fusion Loss

Haowen Bai, Jiangshe Zhang, Zixiang Zhao, Yichen Wu, Lilun Deng, Yukun Cui, Tao Feng, Shuang Xu

专题命中 通用Image Fusion :image fusion(title,abstract);multi-modal image fusion(abstract);分类 cs.CV

Comments Accepted to CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.19854 2025-03-11 cs.CV 83%

One Model for ALL: Low-Level Task Interaction Is a Key to Task-Agnostic Image Fusion

Chunyang Cheng, Tianyang Xu, Zhenhua Feng, Xiaojun Wu, ZhangyongTang, Hui Li, Zeyang Zhang, Sara Atito, Muhammad Awais, Josef Kittler

专题命中 通用Image Fusion :image fusion(title,abstract);multimodal fusion(abstract);分类 cs.CV

Comments Accepted by CVPR 2025 v2

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.03223 2024-09-06 cs.CV 83%

Why mamba is effective? Exploit Linear Transformer-Mamba Network for Multi-Modality Image Fusion

Chenguang Zhu, Shan Gao, Huafeng Chen, Guangqian Guo, Chaowei Wang, Yaoxing Wang, Chen Shu Lei, Quanjiang Fan

专题命中 通用Image Fusion :image fusion(title,abstract);medical image fusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.09293 2024-08-22 cs.CV 83%

A Novel State Space Model with Local Enhancement and State Sharing for Image Fusion

Zihan Cao, Xiao Wu, Liang-Jian Deng, Yu Zhong

专题命中 通用Image Fusion :image fusion(title,abstract);pansharpening(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.08406 2024-04-15 cs.CV 83%

MambaDFuse: A Mamba-based Dual-phase Model for Multi-modality Image Fusion

Zhe Li, Haiwei Pan, Kejia Zhang, Yuhua Wang, Fengming Yu

专题命中 通用Image Fusion :image fusion(title,abstract);medical image fusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.16933 2023-12-29 cs.CV cs.AI 83%

EvPlug: Learn a Plug-and-Play Module for Event and Image Fusion

Jianping Jiang, Xinyu Zhou, Peiqi Duan, Boxin Shi

专题命中 通用Image Fusion :image fusion(title,abstract);multi-modal fusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.06466 2023-10-03 eess.IV 83%

U2Net: A General Framework with Spatial-Spectral-Integrated Double U-Net for Image Fusion

Siran Peng, Chenhao Guo, Xiao Wu, Liang-Jian Deng

专题命中 通用Image Fusion :image fusion(title,abstract);pansharpening(abstract);分类 eess.IV

Comments Accepted by the 31st ACM International Conference on Multimedia (ACM MM '23)

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.06840 2023-08-24 cs.CV 83%

DDFM: Denoising Diffusion Model for Multi-Modality Image Fusion

Zixiang Zhao, Haowen Bai, Yuanzhi Zhu, Jiangshe Zhang, Shuang Xu, Yulun Zhang, Kai Zhang, Deyu Meng, Radu Timofte, Luc Van Gool

专题命中 通用Image Fusion :image fusion(title,abstract);medical image fusion(abstract);分类 cs.CV

Comments Accepted by ICCV 2023 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.11165 2023-08-23 cs.CV 83%

Improving Misaligned Multi-modality Image Fusion with One-stage Progressive Dense Registration

Di Wang, Jinyuan Liu, Long Ma, Risheng Liu, Xin Fan

专题命中 通用Image Fusion :image fusion(title,abstract);infrared and visible(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.03256 2023-08-08 cs.CV 83%

Learning a Graph Neural Network with Cross Modality Interaction for Image Fusion

Jiawei Li, Jiansheng Chen, Jinyuan Liu, Huimin Ma

专题命中 通用Image Fusion :image fusion(title,abstract);infrared and visible(abstract);分类 cs.CV

Comments 9 pages, 10 figures, ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.14461 2023-04-11 cs.CV 83%

CDDFuse: Correlation-Driven Dual-Branch Feature Decomposition for Multi-Modality Image Fusion

Zixiang Zhao, Haowen Bai, Jiangshe Zhang, Yulun Zhang, Shuang Xu, Zudi Lin, Radu Timofte, Luc Van Gool

专题命中 通用Image Fusion :image fusion(title,abstract);medical image fusion(abstract);分类 cs.CV

Comments Accepted by CVPR 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.01392 2023-03-24 cs.CV 83%

Multi-modal Gated Mixture of Local-to-Global Experts for Dynamic Image Fusion

Yiming Sun, Bing Cao, Pengfei Zhu, Qinghua Hu

专题命中 通用Image Fusion :image fusion(title,abstract);infrared and visible(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2209.11277 2022-09-26 cs.CV cs.AI cs.LG 83%

FusionVAE: A Deep Hierarchical Variational Autoencoder for RGB Image Fusion

Fabian Duffhauss, Ngo Anh Vien, Hanna Ziesche, Gerhard Neumann

专题命中 通用Image Fusion :image fusion(title,abstract);sensor fusion(abstract);分类 cs.CV

Comments Accepted at ECCV 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2009.09465 2020-09-22 cs.CV 83%

Remote sensing image fusion based on Bayesian GAN

Junfu Chen, Yue Pan, Yang Chen

专题命中 通用Image Fusion :image fusion(title,abstract);pan-sharpening(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2007.11488 2020-07-23 eess.IV 83%

Analysis and Comparison of Different Wavelet Transform Methods Using Benchmarks for Image Fusion

T Deepika

专题命中 通用Image Fusion :image fusion(title,abstract);medical image fusion(abstract);分类 eess.IV

Comments International Conference on Computer, Communication and Signal Processing

详情

展开后加载摘要…

URL PDF HTML 收藏
1912.10718 2019-12-24 cs.CV 83%

Cross-Modal Image Fusion Theory Guided by Subjective Visual Attention

Aiqing Fang, Xinbo Zhao, Yanning Zhang

专题命中 通用Image Fusion :image fusion(title,abstract);infrared and visible(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
1704.05240 2018-02-07 cs.CV cs.IT math.IT 83%

Image Fusion With Cosparse Analysis Operator

Rui Gao, Sergiy A. Vorobyov, Hong Zhao

专题命中 通用Image Fusion :image fusion(title,abstract);multi-focus(abstract);分类 cs.CV

Comments 12 pages, 4 figures, 1 table, Submitted to IEEE Signal Processing Letters on December 2016

Journal ref IEEE Signal Processing Letters, vol. 24, no. 7, pp. 943-947, July 2017

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.14742 2023-11-28 cs.IR 82%

Query-LIFE: Query-aware Language Image Fusion Embedding for E-Commerce Relevance

Hai Zhu, Yuankai Guo, Ronggang Dou, Kai Liu

专题命中 通用Image Fusion :image fusion(title,abstract);multimodal fusion(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2103.00940 2021-08-04 eess.IV cs.CV 82%

LADMM-Net: An Unrolled Deep Network For Spectral Image Fusion From Compressive Data

Juan Marcos Ramírez, José Ignacio Martínez Torre, Henry Arguello Fuentes

专题命中 通用Image Fusion :image fusion(title,abstract);分类 cs.CV、eess.IV

Comments 29 pages, 15 figures, 4 tables

Journal ref Juan Marcos Ramirez, Jose Ignacio Martinez-Torre, and Henry Arguello, "LADMM-Net: An Unrolled Deep Network For Spectral Image Fusion From Compressive Data", Signal Processing, vol. 189, Dec 2021, 108239

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.11393 2022-08-16 cs.CV 81%

Cross Attention-guided Dense Network for Images Fusion

Zhengwen Shen, Jun Wang, Zaiyu Pan, Yulian Li, Jiangyu Wang

专题命中 通用Image Fusion :image fusion(abstract);multi-modal image fusion(abstract);multi-focus(abstract);multi-exposure(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
1910.04066 2019-10-10 cs.CV 81%

Deep Convolutional Neural Network for Multi-modal Image Restoration and Fusion

Xin Deng, Pier Luigi Dragotti

专题命中 通用Image Fusion :image fusion(abstract);multi-modal image fusion(abstract);multi-focus(abstract);multi-exposure(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏