arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

多模态信息融合

面向图像、视频、多传感器和跨模态感知的信息融合,包括 Image Fusion、红外可见光、遥感、医学影像、LiDAR/雷达/相机和音视频融合。

2026-03-16 至 2026-03-16 共收录 4 信号源:cs.CV, eess.IV, eess.SP, cs.RO, cs.MM

1. 通用Image Fusion 1 篇

2509.17704 2026-03-16 cs.CV 88%

Neurodynamics-Driven Coupled Neural P Systems for Multi-Focus Image Fusion

基于神经动力学的耦合神经P系统用于多焦点图像融合

Bo Li, Yunkuo Lei, Tingting Bao, Hang Yan, Yaxian Wang, Weiping Fu, Lingling Zhang, Jun Liu

机构 * School of Computer Science and Technology, Xi’an Jiaotong University(西安交通大学计算机科学与技术学院) Ministry of Education Key Laboratory of Intelligent Networks and Network Security, China(教育部智能网络与网络安全重点实验室) Shaanxi Province Key Laboratory of Big Data Knowledge Engineering(陕西省大数据知识工程重点实验室) Chang’an University(长安大学)

专题命中 通用Image Fusion :image fusion(title,abstract);multi-focus(title,abstract);分类 cs.CV

AI总结 本文提出基于神经动力学的耦合神经P系统,通过分析神经动力学约束生成高质量决策图,提升多焦点图像融合的准确性。

Comments Accepted by CVPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 音视频/视觉语言融合 1 篇

2603.13056 2026-03-16 cs.CV cs.AI 70%

Team RAS in 10th ABAW Competition: Multimodal Valence and Arousal Estimation Approach

团队RAS在第10届ABAW竞赛中的表现:多模态valence和arousal估计方法

Elena Ryumina, Maxim Markitantov, Alexandr Axyonov, Dmitry Ryumin, Mikhail Dolgushin, Denis Dresvyanskiy, Alexey Karpov

机构 * St. Petersburg Federal Research Center of the Russian Academy of Sciences(俄罗斯科学院圣彼得堡联邦研究中心) ITMO University(ITMO大学)

专题命中 音视频/视觉语言融合 :multimodal fusion(abstract);audio-visual fusion(abstract);分类 cs.CV

AI总结 本文提出一种多模态方法,用于在真实环境中估计valence和arousal。结合面部、行为和音频模态,利用GRADA、Transformer、Qwen3-VL-4B-Instruct和Mamba等技术,实现跨模态融合,最终在Aff-Wild2数据集上达到0.658的CCC值。

Comments 8 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 融合架构与评测 2 篇

2603.12848 2026-03-16 cs.CV cs.AI 57%

Team LEYA in 10th ABAW Competition: Multimodal Ambivalence/Hesitancy Recognition Approach

团队LEYA在第10届ABAW竞赛中的多模态矛盾/犹豫识别方法

Elena Ryumina, Alexandr Axyonov, Dmitry Sysoev, Timur Abdulkadirov, Kirill Almetov, Yulia Morozova, Dmitry Ryumin

机构 * St. Petersburg Federal Research Center of the Russian Academy of Sciences(俄罗斯科学院圣彼得堡联邦科研中心) HSE University(俄罗斯高等经济学院)

专题命中 融合架构与评测 :multimodal fusion(abstract);分类 cs.CV

AI总结 本文提出了一种多模态方法用于视频级矛盾/犹豫识别,结合场景、面部、音频和文本四种模态,通过融合模型提升识别性能,实验显示多模态融合优于单一模态方法。

Comments 8 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.06730 2026-03-16 eess.SY cs.SY 50%

Distributed State Estimation for Discrete-Time Linear Systems over Directed Graphs: A Measurement Perspective

基于有向图的离散时间线性系统分布式状态估计:一种测量视角

Xiaoxu Lyu, Guanghui Wen, Yuezu Lv, Zhisheng Duan, Ling Shi

专题命中 融合架构与评测 :information fusion(abstract)

AI总结 本文提出基于有向图的分布式滤波器,利用集体可观测性条件,通过局部信息确定增益参数,并推导了估计误差协方差的上界及收敛率下界,验证了滤波器性能。

详情

展开后加载摘要…

URL PDF HTML 收藏