arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

多模态信息融合

面向图像、视频、多传感器和跨模态感知的信息融合,包括 Image Fusion、红外可见光、遥感、医学影像、LiDAR/雷达/相机和音视频融合。

共收录 533 信号源:cs.CV, eess.IV, eess.SP, cs.RO, cs.MM

1. 红外-可见光融合 533 篇

2405.20881 2025-06-24 cs.CV 83%

S4Fusion: Saliency-aware Selective State Space Model for Infrared Visible Image Fusion

Haolong Ma, Hui Li, Chunyang Cheng, Gaoang Wang, Xiaoning Song, Xiaojun Wu

机构 * Sino-UK Joint Laboratory on Artificial Intelligence of Ministry of Science and Technology(科技部中英联合人工智能实验室) International Joint Laboratory on Artificial Intelligence of Ministry of Education(教育部国际人工智能联合实验室) School of Artificial Intelligence and Computer Science(人工智能与计算机科学学院) College of Computer Science and Technology(计算机科学与技术学院)

专题命中 红外-可见光融合 :image fusion(title,abstract);infrared and visible(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02439 2025-06-04 cs.CV 83%

Video-Level Language-Driven Video-Based Visible-Infrared Person Re-Identification

Shuang Li, Jiaxu Leng, Changjiang Kuang, Mingpi Tan, Xinbo Gao

机构 * School of Computer Science and Technology, Chongqing University of Posts and Telecommunications(重庆邮电大学计算机科学与技术学院) Chongqing Institute for Brain and Intelligence(重庆脑科学与智能技术研究院) Guangyang Bay Laboratory(广阳湾实验室)

专题命中 红外-可见光融合 :visible-infrared(title,abstract);infrared and visible(abstract);分类 cs.CV

Comments Accepted by IEEE TIFS

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.06159 2025-05-20 cs.CV 83%

A Semantic-Aware and Multi-Guided Network for Infrared-Visible Image Fusion

Xiaoli Zhang, Liying Wang, Libo Zhao, Xiongfei Li, Siwei Ma

机构 * Key Laboratory of Symbolic Computation and Knowledge Engineering of Ministry of Education, Jilin University(教育部符号计算与知识工程重点实验室,吉林大学) Institute of Digital Media, School of Electronic Engineering and Computer Science, Peking University(数字媒体研究所,电子工程与计算机科学学院,北京大学)

专题命中 红外-可见光融合 :image fusion(title,abstract);medical image fusion(abstract);分类 cs.CV

Comments TMM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.02364 2025-05-06 cs.CV 83%

Quaternion Infrared Visible Image Fusion

Weihua Yang, Yicong Zhou

机构 * University of Macau(澳门大学)

专题命中 红外-可见光融合 :image fusion(title,abstract);infrared and visible(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.20764 2024-06-13 cs.CV 83%

CoMoFusion: Fast and High-quality Fusion of Infrared and Visible Image with Consistency Model

Zhiming Meng, Hui Li, Zeyang Zhang, Zhongwei Shen, Yunlong Yu, Xiaoning Song, Xiaojun Wu

专题命中 红外-可见光融合 :infrared and visible(title,abstract);image fusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.13672 2023-08-29 cs.CV 83%

Fusion of Infrared and Visible Images based on Spatial-Channel Attentional Mechanism

Qian Xu

专题命中 红外-可见光融合 :infrared and visible(title,abstract);image fusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.03979 2023-08-09 cs.CV 83%

PAIF: Perception-Aware Infrared-Visible Image Fusion for Attack-Tolerant Semantic Segmentation

Zhu Liu, Jinyuan Liu, Benzhuang Zhang, Long Ma, Xin Fan, Risheng Liu

专题命中 红外-可见光融合 :image fusion(title,abstract);infrared and visible(abstract);分类 cs.CV

Comments Accepted by ACM MM'2023;The source codes are available at https://github.com/LiuZhu-CV/PAIF

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.17376 2023-07-06 cs.CV 83%

DePF: A Novel Fusion Approach based on Decomposition Pooling for Infrared and Visible Images

Hui Li, Yongbiao Xiao, Chunyang Cheng, Zhongwei Shen, Xiaoning Song

专题命中 红外-可见光融合 :infrared and visible(title,abstract);image fusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2103.07302 2023-04-26 cs.CV 83%

Siamese Infrared and Visible Light Fusion Network for RGB-T Tracking

Peng Jingchao, Zhao Haitao, Hu Zhengwei, Zhuang Yi, Wang Bofan

专题命中 红外-可见光融合 :infrared and visible(title,abstract);feature-level fusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.05172 2023-04-18 cs.CV 83%

LRRNet: A Novel Representation Learning Guided Fusion Network for Infrared and Visible Images

Hui Li, Tianyang Xu, Xiao-Jun Wu, Jiwen Lu, Josef Kittler

专题命中 红外-可见光融合 :infrared and visible(title,abstract);image fusion(abstract);分类 cs.CV

Comments 14 pages, 15 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2005.05839 2020-09-04 cs.CV 83%

Bayesian Fusion for Infrared and Visible Images

Zixiang Zhao, Shuang Xu, Chunxia Zhang, Junmin Liu, Jiangshe Zhang

专题命中 红外-可见光融合 :infrared and visible(title,abstract);image fusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.00461 2026-05-04 eess.IV cs.CV 82%

Combined Dictionary Unfolding Network with Gradient-Adaptive Fidelity for Transferable Multi-Source Fusion

结合字典展开网络与梯度自适应保真度的可迁移多源融合

Ge Luo, Jun-Jie Huang, Qi Yu, Tianrui Liu, Ke Liang, Yuming Xiang, Wentao Zhao, Xinwang Liu, Meng Wang

机构 * College of Computer Science and Technology, National University of Defense Technology(国防科技大学计算机科学与技术学院) College of Surveying and Geoinformatics, Tongji University(同济大学测绘与地理信息学院) School of Computer and Information, Hefei University of Technology(合肥工业大学计算机与信息学院)

专题命中 红外-可见光融合 :image fusion(abstract);infrared and visible(abstract);multi-exposure(abstract);medical image fusion(abstract)

AI总结 本文提出CDNet,通过结合字典学习的共同-特定表示先验,设计轻量级结构约束联合展开架构,提升多源图像融合效率与性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.02549 2025-05-07 cs.CV cs.MM 81%

Robust Duality Learning for Unsupervised Visible-Infrared Person Re-Identification

Yongxiang Li, Yuan Sun, Yang Qin, Dezhong Peng, Xi Peng, Peng Hu

机构 * College of Computer Science, Sichuan University(四川大学计算机学院)

专题命中 红外-可见光融合 :visible-infrared(title,abstract);分类 cs.CV、cs.MM

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.19134 2024-12-30 cs.CV cs.LG eess.IV 81%

Extended Cross-Modality United Learning for Unsupervised Visible-Infrared Person Re-identification

Ruixing Wu, Yiming Yang, Jiakai He, Haifeng Hu

专题命中 红外-可见光融合 :visible-infrared(title,abstract);分类 cs.CV、eess.IV

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.15332 2024-09-30 eess.IV cs.CV 81%

A Lightweight GAN-Based Image Fusion Algorithm for Visible and Infrared Images

Zhizhong Wu, Jiajing Chen, LiangHao Tan, Hao Gong, Zhou Yuru, Ge Shi

专题命中 红外-可见光融合 :image fusion(title,abstract);分类 cs.CV、eess.IV

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.12316 2024-06-19 cs.CV cs.AI cs.MM 81%

Enhancing Visible-Infrared Person Re-identification with Modality- and Instance-aware Visual Prompt Learning

Ruiqi Wu, Bingliang Jiao, Wenxuan Wang, Meng Liu, Peng Wang

专题命中 红外-可见光融合 :visible-infrared(title,abstract);分类 cs.CV、cs.MM

Comments Accepyed by ACM International Conference on Multimedia Retrieval (ICMR'24)

Journal ref ICMR'24: Proceedings of the 2024 International Conference on Multimedia Retrieval (2024) 579 - 588

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.00226 2022-12-02 cs.CV cs.IR cs.MM 81%

Learning Progressive Modality-shared Transformers for Effective Visible-Infrared Person Re-identification

Hu Lu, Xuezhang Zou, Pingping Zhang

专题命中 红外-可见光融合 :visible-infrared(title,abstract);分类 cs.CV、cs.MM

Comments This work will appear in AAAI2023, including 8 figures and 6 tables. More improvements may be added

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.05544 2022-11-11 cs.CV eess.IV 81%

Near-infrared and visible-light periocular recognition with Gabor features using frequency-adaptive automatic eye detection

Fernando Alonso-Fernandez, Josef Bigun

专题命中 红外-可见光融合 :infrared and visible(title,abstract);分类 cs.CV、eess.IV

Comments Published at IET Biometrics

详情

展开后加载摘要…

URL PDF HTML 收藏
2102.10526 2022-08-04 cs.CV eess.IV 81%

Deep Decomposition Network for Image Processing: A Case Study for Visible and Infrared Image Fusion

Yu Fu, Xiao-Jun Wu, Josef Kittler

专题命中 红外-可见光融合 :image fusion(title,abstract);分类 cs.CV、eess.IV

详情

展开后加载摘要…

URL PDF HTML 收藏
2002.03322 2020-07-21 cs.CV cs.MM 81%

VIFB: A Visible and Infrared Image Fusion Benchmark

Xingchen Zhang, Ping Ye, Gang Xiao

专题命中 红外-可见光融合 :image fusion(title,abstract);分类 cs.CV、cs.MM

Comments 11 pages, 5 figures, 5 tables. Accepted to CVPRW2020. Compared to the CVPRW2020 version, this version corrects minor mistakes in Table 4 and the first paragraph of Section 4.2

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13045 2026-08-14 cs.CV 新提交 79%

P2Fusion: Prompt-based Progressive Infrared-Visible Image Fusion via Dual-Prior Distillation

P2Fusion:基于提示的双先验蒸馏红外-可见光图像渐进融合

Yi Shi, Huichao Xie, Yuqing Wang, Mingyu Wang, Kaihui Yang, Yu Liu, Ruitao Lu, Lizhe Li, Junwei Han, Dingwen Zhang

机构 * Northwestern Polytechnical University(西北工业大学) Hefei University of Technology(合肥工业大学) Rocket Force University of Engineering(火箭军工程大学) Chongqing University of Posts and Telecommunications(重庆邮电大学)

专题命中 红外-可见光融合 :image fusion(title,abstract);分类 cs.CV

AI总结 针对红外-可见光图像融合的信息差异挑战,提出基于双固有提示的P2Fusion框架,结合Teach-to-Fuse机制与GDER模块,在多数据集上实现SOTA性能并提升下游感知鲁棒性。

Comments Accepted by ECCV 2026. Website: https://p2fusion.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10680 2026-08-12 cs.CV 新提交 79%

Bridging Severe Cross-Modal Misalignment: End-to-End Visible-Infrared Object Detection via Explicit Feature-Domain Affine Registration

缓解严重跨模态错位:通过显式特征域仿射配准实现端到端可见光-红外目标检测

Qi Ming, Yuyang Wang, Mingjing Zhao, Yifan Xiao, Zhixin Guo, Zhiqiang Zhou, Peng Sun, Juan Fang, Fuqiang Yang, Xudong Zhao

机构 * Beijing University of Technology(北京工业大学) Central South University(中南大学) Beijing Electronics Science & Technology Institute(北京电子科学技术研究所) China Aerospace Science & Industry Corporation(中国航天科技集团) Beijing Institute of Technology(北京理工大学) Information Support Force Engineering University(信息支援部队工程大学) Trunk Technology (Beijing) Co., Ltd.(trunk技术(北京)有限公司)

专题命中 红外-可见光融合 :visible-infrared(title,abstract);分类 cs.CV

AI总结 针对可见光-红外目标检测的严重跨模态错位问题,提出JFRDet网络,含CMAA、IGCF、AQCG模块,构建DVMA基准,在该基准上达到69.7% mAP₅₀的SOTA性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01301 2026-08-10 cs.CV cs.AI 版本更新 79%

Ranking Image Fusion the Way Humans Do: A Learned Pairwise Preference Measure for Infrared-Visible Fusion Assessment

以人类方式进行图像融合排序:用于红外-可见光融合评估的学习型成对偏好度量

Haoran Liu, Mingzhe Liu, Peng Li, Guibin Zan

专题命中 红外-可见光融合 :image fusion(title,abstract);分类 cs.CV

AI总结 针对红外-可见光图像融合缺乏理想参考、成对比较成本高的问题,提出LPIFM模型,利用新偏好语料库训练,可准确复现人类成对判断,性能优于传统度量,还公开了相关数据集与代码。

Comments 23 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05634 2026-08-07 cs.MM 新提交 79%

MEC-Patch: Visible-Infrared Cross-Modal Adversarial Attack Driven by Intrinsic Material Emissivity Laws

MEC-Patch:基于本征材料发射率定律的可见-红外跨模态对抗攻击

Zhixiang Huang, Xinbo Nie, Wenxuan Wang, Lu Yang, Xin Li, Xuelin Qian, Peng Wang

专题命中 红外-可见光融合 :visible-infrared(title,abstract);分类 cs.MM

AI总结 本文提出基于斯特藩-玻尔兹曼定律的MEC-Patch跨模态对抗攻击框架,结合NSGA-II与DAR策略,可欺骗多模态检测器并提升环境鲁棒性,为多模态感知系统安全评估提供新思路。

Comments Accepted by the 34th ACM International Conference on Multimedia (MM '26). Includes supplementary material

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10309 2026-08-05 cs.CV 版本更新 79%

CLIP4VI-ReID: Learning Modality-shared Representations via CLIP Semantic Bridge for Visible-Infrared Person Re-identification

CLIP4VI-ReID:通过CLIP语义桥学习模态共享表征用于可见光-红外行人重识别

Xiaomei Yang, Xizhan Gao, Sijie Niu, Fa Zhu, Guang Feng, Xiaofeng Qu, David Camacho

机构 * Shandong Key Laboratory of Ubiquitous Intelligent Computing, School of Information Science and Engineering, University of Jinan(山东 ubiquitous 智能计算重点实验室,信息科学与工程学院,济南大学) College of Information Science and Technology & College of Artificial Intelligence, Nanjing Forestry University(信息科学与技术学院及人工智能学院,南京林业大学) Computer Systems Engineering Department, Universidad Politécnica de Madrid(计算机系统工程系,马德里理工大学)

专题命中 红外-可见光融合 :visible-infrared(title,abstract);分类 cs.CV

AI总结 本文提出CLIP4VI-ReID网络,通过TSG、IFE、HSA模块及CLIP语义桥实现跨模态对齐,在VI-ReID任务上取得优于现有方法的性能。

Comments This article has been accepted for publication in IEEE Transactions on Biometrics, Behavior, and Identity Science

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20238 2026-07-23 cs.CV 新提交 79%

Not All Patches are Equal: Sampling Matters for Visible-Infrared Pre-Training

并非所有补丁都一样:可见-红外预训练中的采样很重要

Qiwei Ma, Bin Deng, Junjie Zhu, Qiangjuan Huang, Puhong Duan, Ke Yang, Xudong Kang, Shutao Li

机构 * Yuelushan Center for Industrial Innovation(岳麓山工业创新中心) Intelligent Game and Decision Lab(智能游戏与决策实验室)

专题命中 红外-可见光融合 :visible-infrared(title,abstract);分类 cs.CV

AI总结 研究针对可见-红外预训练,提出重要性感知采样(IAS)方法,通过从红外结构线索导出权重、学习重要性掩码及采用补丁课程学习策略调整训练重点,在多个VIS-IR基准实验中比基线有改进。

Comments 13 pages, 11 figures,

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18688 2026-07-22 cs.CV 新提交 79%

Dual-Edged Homogeneous-Modality Similarity: Towards Visible-Infrared Modality-Incomplete Person Re-Identification with Modality Adaptive Matching

双边同质模态相似性:迈向具有模态自适应匹配的可见-红外模态不完整行人重识别

Xin Xu, Shuhao Zhan, Wei Liu, Zheng Wang, Kui Jiang, Chia-Wen Lin

专题命中 红外-可见光融合 :visible-infrared(title,abstract);分类 cs.CV

AI总结 研究开放世界场景下可见-红外模态不完整行人重识别问题,提出模态自适应匹配Transformer(MAMT),通过散度Transformer模块和共享Transformer模块提取特征,经模态自适应匹配模块动态融合,在新构建基准上实验,证明方法有效且具适应性。

Comments 18 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15220 2026-07-17 cs.CV 新提交 79%

Structural-Semantic Reciprocal Learning for Unsupervised Visible-Infrared Person Re-Identification

用于无监督可见光-红外行人重识别的结构-语义交互学习

Moyao Tian, Shijia Liu, Yan Yang, Xin Yuan, Minshi Chen, Wei Wang, Xiao Wang

机构 * School of Computer Science and Technology, Wuhan University of Science and Technology(武汉科技大学计算机科学与技术学院) Hubei Province Key Laboratory of Intelligent Information Processing and Real-Time Industrial System, Wuhan University of Science and Technology(武汉科技大学智能信息处理与实时工业系统湖北省重点实验室) Shenyang Institute of Automation, Chinese Academy of Sciences(中国科学院沈阳自动化研究所) China University of Chinese Academy of Sciences(中国科学院大学)

专题命中 红外-可见光融合 :visible-infrared(title,abstract);分类 cs.CV

AI总结 针对无监督可见光-红外行人重识别的挑战,提出结构-语义交互学习框架SSRL。通过细粒度结构解耦和闭环语义校准机制,实现结构与语义学习的交互,有效过滤伪标签噪声,在相关数据集上表现优于现有方法。

Comments Accepted by PRCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12062 2026-06-26 cs.CV 版本更新 79%

Learning Language-Driven Sequence-Level Modal-Invariant Representations for Video-Based Visible-Infrared Person Re-Identification

基于语言驱动的序列级模态不变表示学习用于视频可见光-红外行人重识别

Xiaomei Yang, Antai Liu, Xizhan Gao, Fa Zhu, Sijie Niu, Giancarlo Fortino

机构 * Shandong Key Laboratory of Ubiquitous Intelligent Computing, School of Information Science and Engineering, University of Jinan(山东省 Ubiquitous Intelligent Computing 重点实验室,济南大学信息科学与工程学院) College of Information Science and Technology & Artificial Intelligence, Nanjing Forestry University(信息科学与技术及人工智能学院,南京林业大学) Department of Informatics, Modeling, Electronics, and Systems, University of Calabria(信息学、建模、电子与系统系,卡利博大学)

专题命中 红外-可见光融合 :visible-infrared(title,abstract);分类 cs.CV

AI总结 提出LSMRL方法,通过CLIP的时空特征学习、语义扩散和跨模态交互模块,结合模态级损失,学习序列级模态不变表示,在VVI-ReID任务上超越现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12051 2026-06-11 cs.CV 新提交 79%

MFEN:Multi-Frequency Expert Network for Visible-Infrared Person Re-ID

MFEN:用于可见光-红外行人重识别的多频专家网络

Xulin Li, Yan Lu, Bin Liu, Qinhong Yang, Qi Chu, Tao Gong, Nenghai Yu

机构 * University of Science and Technology of China(中国科学技术大学) Anhui Province Key Laboratory of Digital Security(安徽省数字安全重点实验室) The Chinese University of Hong Kong(香港中文大学)

专题命中 红外-可见光融合 :visible-infrared(title,abstract);分类 cs.CV

AI总结 提出多频专家网络(MFEN),通过多频调制和混合专家设计自适应组合不同频带,结合随机频率增强和频率辅助优化,解决可见光-红外图像模态差异问题。

Comments CVPR Highlight

详情

展开后加载摘要…

URL PDF HTML 收藏