arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

多模态信息融合

面向图像、视频、多传感器和跨模态感知的信息融合,包括 Image Fusion、红外可见光、遥感、医学影像、LiDAR/雷达/相机和音视频融合。

2026-04-23 至 2026-04-23 共收录 6 信号源:cs.CV, eess.IV, eess.SP, cs.RO, cs.MM

1. 通用Image Fusion 1 篇

2604.20128 2026-04-23 cs.CV 57%

Semi-Supervised Flow Matching for Mosaiced and Panchromatic Fusion Imaging

半监督流匹配用于拼接与全色融合成像

Peiming Luo, Nan Wang, Litong Liu, Jiahan Huang, Chenxu Wu, Renwei Dian, Junming Hou

机构 * Southeast University(东南大学) Hunan University(湖南大学)

专题命中 通用Image Fusion :image fusion(abstract);分类 cs.CV

AI总结 本文提出半监督流匹配框架,用于拼接超光谱图像与全色图像融合,通过两阶段训练提升生成效率与鲁棒性,实验表明其在多个数据集上表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 机器人多传感器融合 3 篇

2604.20621 2026-04-23 cs.CR 88%

SoK: The Next Frontier in AV Security: Systematizing Perception Attacks and the Emerging Threat of Multi-Sensor Fusion

SoK:自动驾驶安全的下一个前沿:系统化感知攻击与多传感器融合的新兴威胁

Shahriar Rahman Khan, Tariqul Islam, Raiful Hasan

专题命中 机器人多传感器融合 :sensor fusion(title,abstract);multi-sensor fusion(title,abstract)

AI总结 本文系统化分析了48篇关于自动驾驶感知层攻击的研究,揭示了从单传感器攻击到多传感器融合威胁的发展趋势,指出现有研究在现实测试、短期评估偏见及跨传感器一致性防御方面的不足,并提出融合感知安全的设计方向。

Comments 20 Pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19367 2026-04-23 eess.SP cs.LG stat.ML 74%

Low-Cost Sensor Fusion Framework for Organic Substance Classification and Quality Control Using Classification Methods

低成本传感器融合框架用于有机物质分类和质量控制的分类方法

Borhan Uddin Chowdhury, Damian Valles, Md Raf E Ul Shougat

机构 * Ingram School of Engineering(英格拉姆工程学院) Texas State University(德克萨斯州立大学)

专题命中 机器人多传感器融合 :sensor fusion(title);分类 eess.SP

AI总结 本文提出基于Arduino Mega 2560的低成本传感器融合框架,利用分类方法对有机物质进行快速非破坏性分类和质量控制,通过特征选择和机器学习模型实现高准确率识别。

Comments Copyright 2025 IEEE. This is the author's version of the work accepted for publication in FMLDS 2025. The final version will be published by IEEE and available via DOI (to be inserted when available). Accepted at FMLDS 2025, to appear in IEEE Xplore. 8 pages, 17 figures, 3 tables

Journal ref 2025 IEEE International Conference on Frontiers in Machine Learning and Data Science (FMLDS), IEEE, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20349 2026-04-23 eess.SP 70%

Descriptor: A Hybrid Indoor and Indoor-Outdoor Positioning Multi-Technology Dataset (HYMN)

描述:一种混合室内外定位多技术数据集(HYMN)

Muhammad Ammad, Albrecht Michler, Paul Schwarzbach, Jonas Ninnemann, Hagen Ußler, Oliver Michler

专题命中 机器人多传感器融合 :sensor fusion(abstract);multi-sensor fusion(abstract);分类 eess.SP

AI总结 HYMN数据集结合五种定位技术,涵盖室内外过渡场景,支持多传感器融合和无缝定位研究,克服单一技术限制。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 音视频/视觉语言融合 1 篇

2604.20361 2026-04-23 cs.CV 57%

Object Referring-Guided Scanpath Prediction with Perception-Enhanced Vision-Language Models

基于感知增强的视觉-语言模型的物体指称引导的注视路径预测

Rong Quan, Yantao Lai, Dong Liang, Jie Qin

机构 * Nanjing University of Aeronautics and Astronautics(南京航空航天大学)

专题命中 音视频/视觉语言融合 :information fusion(abstract);分类 cs.CV

AI总结 本文提出ScanVLA模型,通过融合视觉和语言特征提升物体指称引导的注视路径预测性能,引入历史增强解码器和冻结分割LoRA辅助定位,提升预测精度且不增加计算成本。

Comments ICMR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 融合架构与评测 1 篇

2604.20413 2026-04-23 cs.AI 50%

Self-Awareness before Action: Mitigating Logical Inertia via Proactive Cognitive Awareness

行动前的自我意识:通过主动认知意识缓解逻辑惯性

Fulong Fan, Peilin Liu, Fengzhe Liu, Shuyan Yang, Gang Yan

机构 * School of Software, Jilin University(吉林大学软件学院) School of Computer Science, Jilin University(吉林大学计算机科学学院)

专题命中 融合架构与评测 :information fusion(abstract)

AI总结 本文提出SABA框架,通过在最终决策前引入对缺失前提的自我意识,解决大语言模型在非交互谜题中因早期假设传播导致的结论不稳定问题,实现了在多个基准测试中的最佳性能。

Comments Accepted to ACL 2026. 12 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏