arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

多模态信息融合

面向图像、视频、多传感器和跨模态感知的信息融合,包括 Image Fusion、红外可见光、遥感、医学影像、LiDAR/雷达/相机和音视频融合。

共收录 1409 信号源:cs.CV, eess.IV, eess.SP, cs.RO, cs.MM

1. 融合架构与评测 1409 篇

2112.02252 2022-10-05 cs.CV 57%

Channel Exchanging Networks for Multimodal and Multitask Dense Image Prediction

Yikai Wang, Fuchun Sun, Wenbing Huang, Fengxiang He, Dacheng Tao

专题命中 融合架构与评测 :multimodal fusion(abstract);分类 cs.CV

Comments Accepted by TPAMI 2022. Code is available at https://github.com/yikaiw/CEN. arXiv admin note: text overlap with arXiv:2011.05005

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.00812 2022-10-04 cs.RO 57%

A Benchmark for Multi-Modal Lidar SLAM with Ground Truth in GNSS-Denied Environments

Ha Sier, Li Qingqing, Yu Xianjia, Jorge Peña Queralta, Zhuo Zou, Tomi Westerlund

专题命中 融合架构与评测 :sensor fusion(abstract);分类 cs.RO

Comments 6 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2209.13853 2022-09-29 cs.CV 57%

Thinking Hallucination for Video Captioning

Nasib Ullah, Partha Pratim Mohanta

专题命中 融合架构与评测 :multi-modal fusion(abstract);分类 cs.CV

Comments 18 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2209.12694 2022-09-27 cs.CV cs.AI 57%

Multi-modal Video Chapter Generation

Xiao Cao, Zitan Chen, Canyu Le, Lei Meng

专题命中 融合架构与评测 :multi-modal fusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2209.07118 2022-09-16 cs.CL cs.CV 57%

Align, Reason and Learn: Enhancing Medical Vision-and-Language Pre-training with Knowledge

Zhihong Chen, Guanbin Li, Xiang Wan

专题命中 融合架构与评测 :multi-modal fusion(abstract);分类 cs.CV

Comments Natural Language Processing. 10 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2011.00786 2022-08-23 cs.CV 57%

Actor and Action Modular Network for Text-based Video Segmentation

Jianhua Yang, Yan Huang, Kai Niu, Linjiang Huang, Zhanyu Ma, Liang Wang

专题命中 融合架构与评测 :multi-modal fusion(abstract);分类 cs.CV

Comments Accepted By IEEE Transactions on Image Processing

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.02436 2022-08-05 cs.CV 57%

H2-Stereo: High-Speed, High-Resolution Stereoscopic Video System

Ming Cheng, Yiling Xu, Wang Shen, M. Salman Asif, Chao Ma, Jun Sun, Zhan Ma

专题命中 融合架构与评测 :information fusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2207.05993 2022-08-03 cs.CV cs.AI 57%

A new database of Houma Alliance Book ancient handwritten characters and classifier fusion approach

Xiaoyu Yuan, Zhibo Zhang, Yabo Sun, Zekai Xue, Xiuyan Shao, Xiaohua Huang

专题命中 融合架构与评测 :multi-modal fusion(abstract);分类 cs.CV

Comments 11 pages, 7 figures, accepted by 14th International Conference on Graphics and Image Processing (ICGIP 2022)

详情

展开后加载摘要…

URL PDF HTML 收藏
2207.10895 2022-07-26 cs.CV 57%

3D Random Occlusion and Multi-Layer Projection for Deep Multi-Camera Pedestrian Localization

Rui Qiu, Ming Xu, Yuyao Yan, Jeremy S. Smith, Xi Yang

专题命中 融合架构与评测 :information fusion(abstract);分类 cs.CV

Journal ref European Conference on Computer Vision 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2207.08734 2022-07-19 cs.CV 57%

Temporal Lift Pooling for Continuous Sign Language Recognition

Lianyu Hu, Liqing Gao, Zekang Liu, Wei Feng

专题命中 融合架构与评测 :information fusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2207.06604 2022-07-15 cs.CV 57%

Rethinking Super-Resolution as Text-Guided Details Generation

Chenxi Ma, Bo Yan, Qing Lin, Weimin Tan, Siming Chen

专题命中 融合架构与评测 :multi-modal fusion(abstract);分类 cs.CV

Comments 10 pages, 11 figures, ACM MM 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2207.06345 2022-07-14 cs.CV 57%

You Only Align Once: Bidirectional Interaction for Spatial-Temporal Video Super-Resolution

Mengshun Hu, Kui Jiang, Zhixiang Nie, Zheng Wang

专题命中 融合架构与评测 :hybrid fusion(abstract);分类 cs.CV

Comments ACMMM 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2207.03608 2022-07-14 cs.CV 57%

GaitTAKE: Gait Recognition by Temporal Attention and Keypoint-guided Embedding

Hung-Min Hsu, Yizhou Wang, Cheng-Yen Yang, Jenq-Neng Hwang, Hoang Le Uyen Thuc, Kwang-Ju Kim

专题命中 融合架构与评测 :information fusion(abstract);分类 cs.CV

Comments IEEE International Conference on Image Processing 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2206.09114 2022-06-23 cs.CV cs.LG 57%

Bear the Query in Mind: Visual Grounding with Query-conditioned Convolution

Chonghan Chen, Qi Jiang, Chih-Hao Wang, Noel Chen, Haohan Wang, Xiang Li, Bhiksha Raj

专题命中 融合架构与评测 :multi-modal fusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2201.12083 2022-06-22 cs.CV cs.LG 57%

DynaMixer: A Vision MLP Architecture with Dynamic Mixing

Ziyu Wang, Wenhao Jiang, Yiming Zhu, Li Yuan, Yibing Song, Wei Liu

专题命中 融合架构与评测 :information fusion(abstract);分类 cs.CV

Comments icml2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2206.07981 2022-06-20 cs.CV 57%

Multi-scale Cooperative Multimodal Transformers for Multimodal Sentiment Analysis in Videos

Lianyang Ma, Yu Yao, Tao Liang, Tongliang Liu

专题命中 融合架构与评测 :multimodal fusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2107.13740 2022-05-25 eess.SP 57%

Three-dimensional instantaneous orbit map for rotor-bearing system based on a novel multivariate complex variational mode decomposition algorithm

Xiaolong Cui, Jie Huang, Chaoshun Li, Yujie Zhao

专题命中 融合架构与评测 :information fusion(abstract);分类 eess.SP

Comments 29 pages, 32 figures, 41 references

详情

展开后加载摘要…

URL PDF HTML 收藏
2205.10495 2022-05-24 cs.AI cs.CV 57%

Enriched Robust Multi-View Kernel Subspace Clustering

Mengyuan Zhang, Kai Liu

专题命中 融合架构与评测 :information fusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.17191 2022-04-26 cs.CV 57%

Time Lens++: Event-based Frame Interpolation with Parametric Non-linear Flow and Multi-scale Fusion

Stepan Tulyakov, Alfredo Bochicchio, Daniel Gehrig, Stamatios Georgoulis, Yuanyou Li, Davide Scaramuzza

专题命中 融合架构与评测 :feature-level fusion(abstract);分类 cs.CV

Comments IEEE Conference on Computer Vision and Pattern Recognition (CVPR), New Orleans, 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2112.10992 2022-04-26 cs.CV stat.ML 57%

Expansion-Squeeze-Excitation Fusion Network for Elderly Activity Recognition

Xiangbo Shu, Jiawen Yang, Rui Yan, Yan Song

专题命中 融合架构与评测 :multi-modal fusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2204.10803 2022-04-25 cs.CV 57%

Pay "Attention" to Adverse Weather: Weather-aware Attention-based Object Detection

Saket S. Chaturvedi, Lan Zhang, Xiaoyong Yuan

专题命中 融合架构与评测 :multimodal fusion(abstract);分类 cs.CV

Comments This paper is accepted at IEEE International Conference on Pattern Recognition (ICPR), 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2204.10242 2022-04-22 eess.AS cs.LG cs.SD eess.IV 57%

The 2021 NIST Speaker Recognition Evaluation

Seyed Omid Sadjadi, Craig Greenberg, Elliot Singer, Lisa Mason, Douglas Reynolds

专题命中 融合架构与评测 :audio-visual fusion(abstract);分类 eess.IV

详情

展开后加载摘要…

URL PDF HTML 收藏
2204.02485 2022-04-07 cs.CV cs.LG cs.SD eess.AS 57%

Training-Free Robust Multimodal Learning via Sample-Wise Jacobian Regularization

Zhengqi Gao, Sucheng Ren, Zihui Xue, Siting Li, Hang Zhao

专题命中 融合架构与评测 :multimodal fusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.15392 2022-03-30 cs.CV 57%

Efficient Hybrid Network: Inducting Scattering Features

Dmitry Minskiy, Miroslaw Bober

专题命中 融合架构与评测 :hybrid fusion(abstract);分类 cs.CV

Comments Accepted to ICPR-2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2010.00361 2022-03-25 cs.CV 57%

Answer-Driven Visual State Estimator for Goal-Oriented Visual Dialogue

Zipeng Xu, Fangxiang Feng, Xiaojie Wang, Yushu Yang, Huixing Jiang, Zhongyuan Wang

专题命中 融合架构与评测 :information fusion(abstract);分类 cs.CV

Comments Accepted at ACM International Conference on Multimedia (ACM MM 2020)

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.10267 2022-03-22 cs.IT eess.SP math.IT 57%

Hybrid Active and Passive Sensing for SLAM in Wireless Communication Systems

Jie Yang, Chao-Kai Wen, Shi Jin

专题命中 融合架构与评测 :information fusion(abstract);分类 eess.SP

Comments Paper accepted for publication in IEEE Journal on Selected Areas in Communications, 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2111.02387 2022-03-21 cs.CV cs.CL cs.LG 57%

An Empirical Study of Training End-to-End Vision-and-Language Transformers

Zi-Yi Dou, Yichong Xu, Zhe Gan, Jianfeng Wang, Shuohang Wang, Lijuan Wang, Chenguang Zhu, Pengchuan Zhang, Lu Yuan, Nanyun Peng, Zicheng Liu, Michael Zeng

专题命中 融合架构与评测 :multimodal fusion(abstract);分类 cs.CV

Comments CVPR 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2111.00678 2022-03-18 cs.IR cs.LG cs.MM 57%

Latent Structure Mining with Contrastive Modality Fusion for Multimedia Recommendation

Jinghao Zhang, Yanqiao Zhu, Qiang Liu, Mengqi Zhang, Shu Wu, Liang Wang

专题命中 融合架构与评测 :multimodal fusion(abstract);分类 cs.MM

Comments 14 pages; in submission to IEEE TKDE

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.07303 2022-03-15 cs.CV 57%

All in One: Exploring Unified Video-Language Pre-training

Alex Jinpeng Wang, Yixiao Ge, Rui Yan, Yuying Ge, Xudong Lin, Guanyu Cai, Jianping Wu, Ying Shan, Xiaohu Qie, Mike Zheng Shou

专题命中 融合架构与评测 :multimodal fusion(abstract);分类 cs.CV

Comments 18 pages. 11 figures. Code: https://github.com/showlab/all-in-one

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.05465 2022-03-11 cs.CV cs.AI cs.CL cs.LG 57%

LoopITR: Combining Dual and Cross Encoder Architectures for Image-Text Retrieval

Jie Lei, Xinlei Chen, Ning Zhang, Mengjiao Wang, Mohit Bansal, Tamara L. Berg, Licheng Yu

专题命中 融合架构与评测 :multi-modal fusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏