arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

多模态信息融合

面向图像、视频、多传感器和跨模态感知的信息融合,包括 Image Fusion、红外可见光、遥感、医学影像、LiDAR/雷达/相机和音视频融合。

2026-03-31 至 2026-03-31 共收录 7 信号源:cs.CV, eess.IV, eess.SP, cs.RO, cs.MM

1. 融合架构与评测 7 篇

2504.11967 2026-03-31 cs.CV cs.AI cs.RO 62%

Securing the Skies: A Comprehensive Survey on Anti-UAV Methods, Benchmarking, and Future Directions

守护天空:反无人机方法的全面调查、基准测试与未来方向

Yifei Dong, Fengyi Wu, Sanjian Zhang, Guangyu Chen, Yuzhi Hu, Masumi Yano, Jingdong Sun, Siyu Huang, Feng Liu, Qi Dai, Zhi-Qi Cheng

专题命中 融合架构与评测 :multi-modal fusion(abstract);分类 cs.CV、cs.RO

AI总结 本文综述了反无人机领域,探讨了分类、检测与跟踪等核心方法,分析了数据合成、多模态融合等新兴技术,并指出实时性能、 stealth 检测等领域的不足,旨在推动下一代防御策略的发展。

Comments Accepted to CVPR 2025 Anti-UAV Workshop (Best Paper Award), 16 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27781 2026-03-31 cs.CV 57%

GS3LAM: Gaussian Semantic Splatting SLAM

GS3LAM: 基于高斯语义散射的SLAM

Linfei Li, Lin Zhang, Zhong Wang, Ying Shen

机构 * School of Software Engineering, Tongji University(同济大学软件工程学院) Department of Automation, Shanghai Jiaotong University(上海交通大学自动化系)

专题命中 融合架构与评测 :multi-modal fusion(abstract);分类 cs.CV

AI总结 GS3LAM通过多模态数据融合实现实时一致的语义密集地图,采用语义高斯场和多模态误差约束联合优化,引入深度自适应尺度正则化和随机采样关键帧映射策略,提升跟踪鲁棒性和渲染质量。

Comments Accepted by ACM MM 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27181 2026-03-31 cs.RO cs.AI 57%

An End-to-end Flight Control Network for High-speed UAV Obstacle Avoidance based on Event-Depth Fusion

面向高速无人机障碍避让的端到端飞行控制系统:基于事件深度融合

Dikai Shang, Jingyue Zhao, Shi Xu, Nanyang Ye, Lei Wang

机构 * Shanghai jiaotong University(上海交通大学) Defense Innovation Institute, AMS(军事科学院国防科技创新研究院)

专题命中 融合架构与评测 :feature-level fusion(abstract);分类 cs.RO

AI总结 本文提出端到端飞行控制网络,通过双向交叉注意力模块融合深度图像和事件数据,利用模仿学习训练,结合球面主搜索算法设计高效专家规划器,在高速环境下实现更可靠的障碍避让。

Comments 7 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12378 2026-03-31 cs.CV 57%

M4Human: A Large-Scale Multimodal mmWave Radar Benchmark for Human Mesh Reconstruction

M4Human: 一种大规模多模态毫米波雷达基准用于人体网格重建

Junqiao Fan, Yunjiao Zhou, Yizhuo Yang, Xinyuan Cui, Jiarui Zhang, Lihua Xie, Jianfei Yang, Chris Xiaoxuan Lu, Fangqiang Ding

机构 * NTU(南洋理工大学) University of Edinburgh(爱丁堡大学) UPenn(宾夕法尼亚大学) UCL(伦敦大学学院) MIT(麻省理工学院)

专题命中 融合架构与评测 :multimodal fusion(abstract);分类 cs.CV

AI总结 本文提出M4Human,首个大规模多模态毫米波雷达基准,提供高分辨率雷达、RGB和深度数据,用于解决传统视觉传感的遮挡、光照和隐私问题,推动人体建模研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26746 2026-03-31 cs.CV cs.LG 57%

TDEC: Deep Embedded Image Clustering with Transformer and Distribution Information

TDEC:基于Transformer和分布信息的深度嵌入图像聚类

Ruilin Zhang, Haiyang Zheng, Hongpeng Wang

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Peng Cheng Laboratory(鹏城实验室)

专题命中 融合架构与评测 :information fusion(abstract);分类 cs.CV

AI总结 本文提出TDEC,通过结合Transformer和分布信息,改进图像聚类中的特征表示和维度偏好,提升聚类性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28115 2026-03-31 cs.LG 50%

Graph Vector Field: A Unified Framework for Multimodal Health Risk Assessment from Heterogeneous Wearable and Environmental Data Streams

图向量场:一种统一的多模态健康风险评估框架,用于异构可穿戴和环境数据流

Silvano Coletti, Francesca Fallucchi

机构 * Università degli Studi Guglielmo Marconi, Roma, Italy(意大利罗马古列尔莫·马可尼大学) Chelonia SA, Lugano, Switzerland(瑞士卢加诺Chelonia SA)

专题命中 融合架构与评测 :multimodal fusion(abstract)

AI总结 本文提出图向量场框架,通过结合离散微分几何算子与模态结构混合专家,统一多模态健康风险评估,实现可解释的模态解析风险建模。

Comments 25 pages, 6 appendices. Theoretical framework; no empirical experiments

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20013 2026-03-31 eess.SY cs.SY 50%

Steady State Distributed Kalman Filter

稳态分布式卡尔曼滤波

Francisco Rego

专题命中 融合架构与评测 :information fusion(abstract)

AI总结 本文提出一种最优固定增益分布式观测器,用于无线传感器网络中离散时间线性系统的稳态估计,通过离线计算全局分布式BLUE估计器的渐近误差协方差确定固定观测器增益,实现最优渐近性能。

详情

展开后加载摘要…

URL PDF HTML 收藏