arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

多模态信息融合

面向图像、视频、多传感器和跨模态感知的信息融合,包括 Image Fusion、红外可见光、遥感、医学影像、LiDAR/雷达/相机和音视频融合。

共收录 1406 信号源:cs.CV, eess.IV, eess.SP, cs.RO, cs.MM

1. 融合架构与评测 1406 篇

2506.19341 2025-06-25 cs.CV 57%

Trajectory Prediction in Dynamic Object Tracking: A Critical Study

Zhongping Dong, Liming Chen, Mohand Tahar Kechadi

专题命中 融合架构与评测 :information fusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17136 2025-06-23 cs.CV 57%

Semi-Supervised Multi-Modal Medical Image Segmentation for Complex Situations

Dongdong Meng, Sheng Li, Hao Wu, Guoping Wang, Xueqing Yan

机构 * School of Physics, Peking University, Beijing, China(北京大学物理系) School of Computer Science, Peking University, Beijing, China(北京大学计算机系) Department of Radiotherapy, Peking University Cancer Hospital, Beijing, China(北京大学肿瘤医院放疗科)

专题命中 融合架构与评测 :multi-modal fusion(abstract);分类 cs.CV

Comments 10 pages, 2 figures, accepted at MICCAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19507 2025-05-27 cs.CV cs.LG 57%

Multimodal Machine Translation with Visual Scene Graph Pruning

Chenyu Lu, Shiliang Sun, Jing Zhao, Nan Zhang, Tengfei Song, Hao Yang

机构 * East China Normal University(东华师范大学) Shanghai Jiao Tong University(上海交通大学) Wenzhou University(温州大学) Huawei Technologies Ltd(华为技术有限公司)

专题命中 融合架构与评测 :information fusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17501 2025-05-26 cs.CV cs.AI cs.LG 57%

RoHyDR: Robust Hybrid Diffusion Recovery for Incomplete Multimodal Emotion Recognition

Yuehan Jin, Xiaoqing Liu, Yiyuan Yang, Zhiwen Yu, Tong Zhang, Kaixiang Yang

机构 * School of Computer Science and Engineering(计算机科学与工程学院) South China University of Technology(华南理工大学) School of Future Technology(未来技术学院) University of Oxford(牛津大学) Pengcheng Laboratory(鹏城实验室) Department of Computer Science(计算机科学系)

专题命中 融合架构与评测 :multimodal fusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.10836 2025-05-19 cs.CL cs.CV 57%

Multimodal Event Detection: Current Approaches and Defining the New Playground through LLMs and VLMs

Abhishek Dey, Aabha Bothera, Samhita Sarikonda, Rishav Aryan, Sanjay Kumar Podishetty, Akshay Havalgi, Gaurav Singh, Saurabh Srivastava

机构 * George Mason University(乔治·马歇尔大学) Amazon(亚马逊公司)

专题命中 融合架构与评测 :multimodal fusion(abstract);分类 cs.CV

Comments Accepted at NLDB 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.04616 2025-05-08 cs.CV 57%

Person Recognition at Altitude and Range: Fusion of Face, Body Shape and Gait

Feng Liu, Nicholas Chimitt, Lanqing Guo, Jitesh Jain, Aditya Kane, Minchul Kim, Wes Robbins, Yiyang Su, Dingqiang Ye, Xingguang Zhang, Jie Zhu, Siddharth Satyakam, Christopher Perry, Stanley H. Chan, Arun Ross, Humphrey Shi, Zhangyang Wang, Anil Jain, Xiaoming Liu

机构 * Department of Computer Science and Engineering, Michigan State University(计算机科学与工程系,密歇根州立大学) School of Electrical and Computer Engineering, Purdue University(电气与计算机工程学院,普渡大学) School of Interactive Computing, Georgia Tech(交互计算学院,佐治亚理工学院) Department of Electrical and Computer Engineering, University of Texas at Austin(电气与计算机工程系,德克萨斯大学奥斯汀分校)

专题命中 融合架构与评测 :multi-modal fusion(abstract);分类 cs.CV

Comments 18 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.04791 2025-04-08 eess.SP 57%

Localization and Tracking for Cooperative Users in Multi-RIS-assisted Systems: Theoretical Analysis and Principles of Interpretations

Peng Gao, Lixiang Lian, Yuan Shen

专题命中 融合架构与评测 :information fusion(abstract);分类 eess.SP

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.16182 2025-04-08 cs.CV 57%

No Re-Train, More Gain: Upgrading Backbones with Diffusion model for Pixel-Wise and Weakly-Supervised Few-Shot Segmentation

Shuai Chen, Fanman Meng, Chenhao Wu, Haoran Wei, Runtong Zhang, Qingbo Wu, Linfeng Xu, Hongliang Li

专题命中 融合架构与评测 :information fusion(abstract);分类 cs.CV

Comments 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.16198 2025-04-07 cs.CV 57%

Interpreting Object-level Foundation Models via Visual Precision Search

Ruoyu Chen, Siyuan Liang, Jingzhi Li, Shiming Liu, Maosen Li, Zhen Huang, Hua Zhang, Xiaochun Cao

专题命中 融合架构与评测 :multimodal fusion(abstract);分类 cs.CV

Comments Accepted to CVPR 2025 (Highlight)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.01767 2025-04-03 eess.AS cs.AI cs.CV 57%

Leveraging Embedding Techniques in Multimodal Machine Learning for Mental Illness Assessment

Abdelrahaman A. Hassan, Abdelrahman A. Ali, Aya E. Fouda, Radwa J. Hanafy, Mohammed E. Fouda

专题命中 融合架构与评测 :decision-level fusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.04738 2025-04-02 cs.CV 57%

Diffusion Models in 3D Vision: A Survey

Zhen Wang, Dongyuan Li, Yaozu Wu, Tianyu He, Jiang Bian, Renhe Jiang

专题命中 融合架构与评测 :multimodal fusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13951 2025-03-19 cs.CV cs.AI 57%

FrustumFusionNets: A Three-Dimensional Object Detection Network Based on Tractor Road Scene

Lili Yang, Mengshuai Chang, Xiao Guo, Yuxin Feng, Yiwen Mei, Caicong Wu

专题命中 融合架构与评测 :hybrid fusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.07696 2025-03-19 cs.LG cs.CV 57%

Flatness Improves Backbone Generalisation in Few-shot Classification

Rui Li, Martin Trapp, Marcus Klasson, Arno Solin

专题命中 融合架构与评测 :information fusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.07496 2025-03-17 cs.CV 57%

Aligning First, Then Fusing: A Novel Weakly Supervised Multimodal Violence Detection Method

Wenping Jin, Li Zhu, Jing Sun

专题命中 融合架构与评测 :multimodal fusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10057 2025-03-14 cs.CV 57%

Multi-Modal Mamba Modeling for Survival Prediction (M4Survive): Adapting Joint Foundation Model Representations

Ho Hin Lee, Alberto Santamaria-Pang, Jameson Merkov, Matthew Lungren, Ivan Tarapov

专题命中 融合架构与评测 :multi-modal fusion(abstract);分类 cs.CV

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.04851 2025-03-14 cs.CV 57%

AdaptiveFusion: Adaptive Multi-Modal Multi-View Fusion for 3D Human Body Reconstruction

Anjun Chen, Xiangyu Wang, Zhi Xu, Kun Shi, Yan Qin, Yuchi Huo, Jiming Chen, Qi Ye

专题命中 融合架构与评测 :multi-modal fusion(abstract);分类 cs.CV

Comments TMM 2025, Project Page: https://chen3110.github.io/adaptivefusion/index.html

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.05052 2025-03-13 eess.SP 57%

A Marginal Distributionally Robust Kalman Filter for Centralized Fusion

Weizhi Chen, Yaowen Li, Yu Liu, You He

专题命中 融合架构与评测 :information fusion(abstract);分类 eess.SP

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.00260 2025-03-11 cs.CV 57%

GazeCLIP: Enhancing Gaze Estimation Through Text-Guided Multimodal Learning

Jun Wang, Hao Ruan, Liangjian Wen, Yong Dai, Mingjie Wang

专题命中 融合架构与评测 :multimodal fusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.11476 2025-03-11 eess.SP 57%

A Model Fusion Distributed Kalman Filter For Non-Gaussian Observation Noise

Xuemei Mao, Gang Wang, Bei Peng, Jiacheng He, Kun Zhang, Song Gao, Jian Chen

专题命中 融合架构与评测 :information fusion(abstract);分类 eess.SP

Comments This paper has been accepted and published in IEEE Internet of Things Journal (Early Access), 2025. The final published version is available at: https://doi.org/10.1109/JIOT.2025.3526240

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.11926 2025-03-10 cs.IT eess.SP math.IT 57%

Multi-Modal Variable-Rate CSI Reconstruction for FDD Massive MIMO Systems

Yunseo Nam, Jiwook Choi

专题命中 融合架构与评测 :multi-modal fusion(abstract);分类 eess.SP

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.09193 2025-03-07 cs.CV cs.AI cs.LG q-bio.NC 57%

Can We Talk Models Into Seeing the World Differently?

Paul Gavrikov, Jovita Lukasik, Steffen Jung, Robert Geirhos, M. Jehanzeb Mirza, Margret Keuper, Janis Keuper

专题命中 融合架构与评测 :multi-modal fusion(abstract);分类 cs.CV

Comments Accepted at ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.03220 2025-03-06 eess.SP 57%

Joint Bistatic Positioning and Monostatic Sensing: Optimized Beamforming and Performance Tradeoff

Yuchen Zhang, Hui Chen, Pinjun Zheng, Boyu Ning, Hong Niu, Henk Wymeersch, Tareq Y. Al-Naffouri

专题命中 融合架构与评测 :information fusion(abstract);分类 eess.SP

Comments This work has been submitted to IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15711 2025-02-25 cs.IR cs.MM 57%

A Survey on Multimodal Recommender Systems: Recent Advances and Future Directions

Jinfeng Xu, Zheyu Chen, Shuo Yang, Jinze Li, Wei Wang, Xiping Hu, Steven Hoi, Edith Ngai

专题命中 融合架构与评测 :multimodal fusion(abstract);分类 cs.MM

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.05534 2025-02-11 cs.CV 57%

Fg-T2M++: LLMs-Augmented Fine-Grained Text Driven Human Motion Generation

Yin Wang, Mu Li, Jiapeng Liu, Zhiying Leng, Frederick W. B. Li, Ziyao Zhang, Xiaohui Liang

专题命中 融合架构与评测 :multi-modal fusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01158 2025-02-05 cs.LG cs.AI cs.CV 57%

MIND: Modality-Informed Knowledge Distillation Framework for Multimodal Clinical Prediction Tasks

Alejandro Guerra-Manzanares, Farah E. Shamout

专题命中 融合架构与评测 :multimodal fusion(abstract);分类 cs.CV

Comments Published in Transactions on Machine Learning Research (01/2025), https://openreview.net/forum?id=BhOJreYmur&noteId=ymnAhncuez

Journal ref Transactions on Machine Learning Research (TMLR), 01/2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.13708 2025-02-04 cs.CV 57%

JoVALE: Detecting Human Actions in Video Using Audiovisual and Language Contexts

Taein Son, Soo Won Seo, Jisong Kim, Seok Hwan Lee, Jun Won Choi

专题命中 融合架构与评测 :multi-modal fusion(abstract);分类 cs.CV

Comments Accepted to AAAI Conference on Artificial Intelligence 2025, 10 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.02363 2025-01-28 cs.CV cs.MA 57%

V2X-DGPE: Addressing Domain Gaps and Pose Errors for Robust Collaborative 3D Object Detection

Sichao Wang, Ming Yuan, Chuang Zhang, Qing Xu, Lei He, Jianqiang Wang

专题命中 融合架构与评测 :information fusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.08900 2025-01-16 cs.CV 57%

Enhanced Multi-Scale Cross-Attention for Person Image Generation

Hao Tang, Ling Shao, Nicu Sebe, Luc Van Gool

专题命中 融合架构与评测 :multi-modal fusion(abstract);分类 cs.CV

Comments Accepted to TPAMI, an extended version of a paper published in ECCV2020. arXiv admin note: substantial text overlap with arXiv:2007.09278

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.06710 2025-01-14 cs.CV cs.AI 57%

Multi-task Visual Grounding with Coarse-to-Fine Consistency Constraints

Ming Dai, Jian Li, Jiedong Zhuang, Xian Zhang, Wankou Yang

专题命中 融合架构与评测 :multimodal fusion(abstract);分类 cs.CV

Comments AAAI2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.12460 2025-01-14 cs.CV 57%

PromptDet: A Lightweight 3D Object Detection Framework with LiDAR Prompts

Kun Guo, Qiang Ling

专题命中 融合架构与评测 :multi-modal fusion(abstract);分类 cs.CV

Comments Accepted by AAAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏