arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

多模态信息融合

面向图像、视频、多传感器和跨模态感知的信息融合,包括 Image Fusion、红外可见光、遥感、医学影像、LiDAR/雷达/相机和音视频融合。

2026-05-01 至 2026-05-01 共收录 2 信号源:cs.CV, eess.IV, eess.SP, cs.RO, cs.MM

1. 融合架构与评测 2 篇

2604.27259 2026-05-01 cs.CV cs.LG 57%

VTBench: A Multimodal Framework for Time-Series Classification with Chart-Based Representations

VTBench: 一种基于图表表示的多模态时间序列分类框架

Madhumitha Venkatesan, Xuyang Chen, Dongyu Liu

机构 * University of California, Davis(加州大学戴维斯分校)

专题命中 融合架构与评测 :multimodal fusion(abstract);分类 cs.CV

AI总结 本文提出VTBench,通过融合原始序列和图表可视化,系统评估了时间序列分类中图表类型、视觉编码和数据集的影响,展示了图表模型在特定领域的竞争力及多模态融合的优势。

Comments 8 pages main text

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.12022 2026-05-01 cs.AI 50%

AI Models for Depressive Disorder Detection and Diagnosis: A Review

用于抑郁症检测和诊断的AI模型:综述

Dorsa Macky Aleagha, Payam Zohari, Mostafa Haghir Chehreghani

专题命中 融合架构与评测 :multimodal fusion(abstract)

AI总结 本文综述了55项研究中的最新AI方法,提出层次分类体系,揭示图神经网络、大语言模型和多模态融合三大趋势,提供数据集和评估指标,为计算精神病学未来创新提供路线图。

详情

展开后加载摘要…

URL PDF HTML 收藏