arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

多模态信息融合

面向图像、视频、多传感器和跨模态感知的信息融合,包括 Image Fusion、红外可见光、遥感、医学影像、LiDAR/雷达/相机和音视频融合。

共收录 4754 信号源:cs.CV, eess.IV, eess.SP, cs.RO, cs.MM

1. 自动驾驶多传感器融合 261 篇

2602.08126 2026-02-13 cs.CV 57%

MambaFusion: Adaptive State-Space Fusion for Multimodal 3D Object Detection

MambaFusion:多模态3D目标检测的自适应状态空间融合

Venkatraman Narayanan, Bala Sai, Rahul Ahuja, Pratik Likhar, Varun Ravi Kumar, Senthil Yogamani

机构 * Qualcomm Technologies, Inc(高通技术公司) Qualcomm India Private Limited(高通印度私人有限公司)

专题命中 自动驾驶多传感器融合 :multimodal fusion(abstract);分类 cs.CV

AI总结 MambaFusion通过结合选择性状态空间模型与窗口化变换器,实现高效且可靠的多模态3D目标检测,提升自动驾驶系统的感知能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18757 2026-01-13 cs.CV 57%

From Features to Reference Points: Lightweight and Adaptive Fusion for Cooperative Autonomous Driving

从特征到参考点:轻量且自适应的融合用于协同自动驾驶

Yongqi Zhu, Morui Zhu, Qi Chen, Deyuan Qu, Isabella Luo, Song Fu, Qing Yang

机构 * University of North Texas(北卡罗来纳大学达灵顿分校) Toyota InfoTech Labs(丰田信息技术实验室) The Hockaday School(霍克达伊学校)

专题命中 自动驾驶多传感器融合 :feature-level fusion(abstract);分类 cs.CV

AI总结 RefPtsFusion通过交换紧凑的参考点实现轻量且自适应的协同自动驾驶融合,显著降低通信开销并保持感知性能。

Comments v2: Updated author list to reflect contributions to this work

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13107 2025-12-19 cs.CV cs.AI 57%

Diffusion-Based Restoration for Multi-Modal 3D Object Detection in Adverse Weather

基于扩散的多模态3D物体检测在恶劣天气中的修复

Zhijian He, Feifei Liu, Yuwei Li, Zhanpeng Luo, Jintao Cheng, Xieyuanli Chen, Xiaoyu Tang

机构 * School of Xingzhi College, South China Normal University(星智学院,华南师范大学) College of Big Data and Internet, Shenzhen Technology University(大数据与互联网学院,深圳科技大学) School of Data Science and Engineering, Xingzhi College, South China Normal University(数据科学与工程学院,星智学院,华南师范大学) Department of Electronic and Computer Engineering, Hong Kong University of Science and Technology(电子与计算机工程系,香港科技大学) College of Intelligence Science and Technology, National University of Defense Technology(智能科学与技术学院,国防科技大学)

专题命中 自动驾驶多传感器融合 :multi-modal fusion(abstract);分类 cs.CV

AI总结 DiffFusion通过基于扩散的修复和自适应跨模态融合,提升多模态3D物体检测在恶劣天气中的鲁棒性与清洁数据性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06666 2025-11-11 cs.CV 57%

REOcc: Camera-Radar Fusion with Radar Feature Enrichment for 3D Occupancy Prediction

Chaehee Song, Sanmin Kim, Hyeonjun Jeong, Juyeb Shin, Joonhee Lim, Dongsuk Kum

机构 * School of Electrical Engineering, Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院电子工程学院) Department of Automobile and IT Convergence, Kookmin University(韩国庆熙大学汽车与IT融合系) Cho Chun Shik Graduate School of Mobility, Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院移动技术研究生院) Robotics Program, Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院机器人项目)

专题命中 自动驾驶多传感器融合 :sensor fusion(abstract);分类 cs.CV

Comments IROS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01768 2025-11-04 cs.CV 57%

UniLION: Towards Unified Autonomous Driving Model with Linear Group RNNs

Zhe Liu, Jinghua Hou, Xiaoqing Ye, Jingdong Wang, Hengshuang Zhao, Xiang Bai

机构 * School of Electronic Information and Communications, Huazhong University of Science and Technology (HUST), Wuhan, China(华中科技大学电子信息与通信学院) School of Software Engineering, Huazhong University of Science and Technology (HUST), Wuhan, China(华中科技大学软件工程学院) Department of Computer Science, The University of Hong Kong, Hong Kong (HKU) SAR, China(香港大学计算机系) Baidu Inc., Beijing, China(百度公司)

专题命中 自动驾驶多传感器融合 :multi-modal fusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.19215 2025-10-23 cs.CV 57%

SFGFusion: Surface Fitting Guided 3D Object Detection with 4D Radar and Camera Fusion

Xiaozhi Li, Huijun Di, Jian Li, Feng Liu, Wei Liang

机构 * Radar Technology Research Institute, School of Information and Electronics, Beijing Institute of Technology(雷达技术研究院,信息电子学院,北京理工大学) School of Computer Science and Technology, Beijing Institute of Technology(计算机科学与技术学院,北京理工大学) Innovative Equipment Research Institute, Beijing Institute of Technology(创新装备研究院,北京理工大学) Key Laboratory of Electronic and Information Technology in Satellite Navigation (Beijing Institute of Technology), Ministry of Education(卫星导航电子信息技术重点实验室(北京理工大学),教育部) Beijing Racobit Electronic Information Technology Co., Ltd.(北京瑞科比特电子信息技术有限公司)

专题命中 自动驾驶多传感器融合 :multi-modal fusion(abstract);分类 cs.CV

Comments Submitted to Pattern Recognition

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.18743 2025-09-24 cs.CV 57%

TriFusion-AE: Language-Guided Depth and LiDAR Fusion for Robust Point Cloud Processing

Susmit Neogi

机构 * Department of Mechanical Engineering(机械工程系) Indian Institute of Technology Bombay(印度理工学院班加罗尔) Mumbai, India(孟买,印度)

专题命中 自动驾驶多传感器融合 :multimodal fusion(abstract);分类 cs.CV

Comments 39th Conference on Neural Information Processing Systems (NeurIPS 2025) Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.18609 2025-09-24 cs.RO 57%

PIE: Perception and Interaction Enhanced End-to-End Motion Planning for Autonomous Driving

Chengran Yuan, Zijian Lu, Zhanqi Zhang, Yimin Zhao, Zefan Huang, Shuo Sun, Jiawei Sun, Jiahui Li, Christina Dao Wen Lee, Dongen Li, Marcelo H. Ang

机构 * Department of Mechanical Engineering, National University of Singapore(机械工程系,国立新加坡大学) Department of Civil and Environmental Engineering, National University of Singapore(土木与环境工程系,国立新加坡大学)

专题命中 自动驾驶多传感器融合 :multimodal fusion(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.11762 2025-08-21 cs.LG cs.RO 57%

MUVO: A Multimodal Generative World Model for Autonomous Driving with Geometric Representations

Daniel Bogdoll, Yitian Yang, Tim Joseph, Melih Yazgan, J. Marius Zöllner

机构 * FZI Research Center for Information Technology, Germany(德国弗赖堡信息科技研究中心) Karlsruhe Institute of Technology, Germany(德国卡尔斯鲁厄理工学院)

专题命中 自动驾驶多传感器融合 :sensor fusion(abstract);分类 cs.RO

Comments Daniel Bogdoll and Yitian Yang contributed equally. Accepted for publication at IV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07453 2025-08-12 eess.SY cs.AI cs.MA cs.RO cs.SY 57%

Noise-Aware Generative Microscopic Traffic Simulation

Vindula Jayawardana, Catherine Tang, Junyi Ji, Jonah Philion, Xue Bin Peng, Cathy Wu

机构 * Massachusetts Institute of Technology(麻省理工学院) Vanderbilt University(范德比大学) NVIDIA Corporation(NVIDIA公司)

专题命中 自动驾驶多传感器融合 :sensor fusion(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.15384 2025-08-11 cs.CV cs.AI 57%

MetaOcc: Spatio-Temporal Fusion of Surround-View 4D Radar and Camera for 3D Occupancy Prediction with Dual Training Strategies

Long Yang, Lianqing Zheng, Wenjin Ai, Minghao Liu, Sen Li, Qunshu Lin, Shengyu Yan, Jie Bai, Zhixiong Ma, Tao Huang, Xichan Zhu

机构 * School of Automotive Studies, Tongji University(同济大学汽车学院) College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) School of Automobile, Chang'an University(长安大学汽车学院) School of Information and Electrical Engineering, Hangzhou City University(杭州城市学院信息与电气工程学院) College of Science and Engineering, James Cook University(詹姆斯库克大学科学与工程学院)

专题命中 自动驾驶多传感器融合 :multi-modal fusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.10376 2025-07-15 cs.RO 57%

Raci-Net: Ego-vehicle Odometry Estimation in Adverse Weather Conditions

Mohammadhossein Talebi, Pragyan Dahal, Davide Possenti, Stefano Arrigoni, Francesco Braghin

机构 * Politecnico di Milano(米兰理工大学) Michigan State University(密歇根州立大学)

专题命中 自动驾驶多传感器融合 :sensor fusion(abstract);分类 cs.RO

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.10715 2025-07-14 cs.CV 57%

EVT: Efficient View Transformation for Multi-Modal 3D Object Detection

Yongjin Lee, Hyeon-Mun Jeong, Yurim Jeon, Sanghyun Kim

机构 * ThorDrive Co., Ltd(ThorDrive公司) Seoul National University(首尔国立大学)

专题命中 自动驾驶多传感器融合 :sensor fusion(abstract);分类 cs.CV

Comments Accepted to ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.07938 2025-07-11 cs.MM 57%

Multimodal Framework for Explainable Autonomous Driving: Integrating Video, Sensor, and Textual Data for Enhanced Decision-Making and Transparency

Abolfazl Zarghani, Amirhossein Ebrahimi, Amir Malekesfandiari

专题命中 自动驾驶多传感器融合 :sensor fusion(abstract);分类 cs.MM

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.01484 2025-07-03 cs.CV 57%

What Really Matters for Robust Multi-Sensor HD Map Construction?

Xiaoshuai Hao, Yuting Zhao, Yuheng Ji, Luanyuan Dai, Peng Hao, Dingzhe Li, Shuai Cheng, Rong Yin

机构 * Beijing Academy of Artificial Intelligence(北京人工智能研究院) Institute of Automation, Chinese Academy of Science(中国科学院自动化研究所) Nanjing University of Science and Technology(南京理工大学) Samsung R&D Institute China–Beijing(三星中国北京研发中心) China North Artificial Intelligent & Innovation Research Institute(中国北方人工智能与创新研究院) Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所)

专题命中 自动驾驶多传感器融合 :multi-modal fusion(abstract);分类 cs.CV

Comments Accepted by IROS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12696 2025-06-23 cs.CV 57%

Collaborative Perception Datasets for Autonomous Driving: A Review

Naibang Wang, Deyong Shang, Yan Gong, Xiaoxi Hu, Ziying Song, Lei Yang, Yuhan Huang, Xiaoyu Wang, Jianli Lu

机构 * School of Mechanical and Electrical Engineering, China University of Mining and Technology (Beijing)(中国矿业大学(北京)机械与电子工程学院) State Key Laboratory of Robotics and System, Harbin Institute of Technology(哈尔滨工业大学机器人系统国家重点实验室) State Key Laboratory of Intelligent Green Vehicle and Mobility, Tsinghua University(清华大学智能绿色车辆与移动系统国家重点实验室) School of Mechanical and Aerospace Engineering, Nanyang Technological University(南洋理工大学机械与航空航天工程学院) School of Mechatronics Engineering, Harbin Institute of Technology(哈尔滨工业大学机械电子工程学院) Department of Electronic & Electrical Engineering, University of Bath(巴斯大学电子与电气工程系)

专题命中 自动驾驶多传感器融合 :information fusion(abstract);分类 cs.CV

Comments 18pages, 7figures, journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21079 2025-05-28 cs.CV 57%

Uni3D-MoE: Scalable Multimodal 3D Scene Understanding via Mixture of Experts

Yue Zhang, Yingzhao Jian, Hehe Fan, Yi Yang, Roger Zimmermann

机构 * Zhejiang University(浙江大学) National University of Singapore(新加坡国立大学)

专题命中 自动驾驶多传感器融合 :multimodal fusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15005 2025-05-22 cs.RO cs.SE 57%

UniSTPA: A Safety Analysis Framework for End-to-End Autonomous Driving

Hongrui Kou, Zhouhang Lyu, Ziyu Wang, Cheng Wang, Yuxin Zhang

机构 * National Key Laboratory of Automotive Chassis Integration and Bionics, Jilin University, Changchun, China(吉林大学汽车底盘集成与仿生国家级重点实验室) School of Engineering and Physical Sciences, Heriot‐Watt University, Edinburgh, United Kingdom(赫瑞-沃森大学工程与物理科学学院)

专题命中 自动驾驶多传感器融合 :sensor fusion(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12693 2025-05-20 cs.CV 57%

TACOcc:Target-Adaptive Cross-Modal Fusion with Volume Rendering for 3D Semantic Occupancy

Luyao Lei, Shuo Xu, Yifan Bai, Xing Wei

机构 * School of Software Engineering(软件工程学院) Xi’an Jiaotong University(西安交通大学)

专题命中 自动驾驶多传感器融合 :multi-modal fusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.09422 2025-05-15 cs.CV 57%

MoRAL: Motion-aware Multi-Frame 4D Radar and LiDAR Fusion for Robust 3D Object Detection

Xiangyuan Peng, Yu Wang, Miao Tang, Bierzynski Kay, Lorenzo Servadei, Robert Wille

机构 * Technical University of Munich(慕尼黑技术大学) Infineon Technologies AG(英飞凌科技AG) China University of Geosciences(中国地质大学)

专题命中 自动驾驶多传感器融合 :multi-modal fusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.16368 2025-04-24 cs.CV 57%

Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection

Linhua Kong, Dongxia Chang, Lian Liu, Zisen Kong, Pengyuan Li, Yao Zhao

机构 * IEEE Publication Technology Department(IEEE出版技术部)

专题命中 自动驾驶多传感器融合 :radar camera fusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.08172 2025-04-14 cs.RO 57%

Enhanced Cooperative Perception Through Asynchronous Vehicle to Infrastructure Framework with Delay Mitigation for Connected and Automated Vehicles

Nithish Kumar Saravanan, Varun Jammula, Yezhou Yang, Jeffrey Wishart, Junfeng Zhao

专题命中 自动驾驶多传感器融合 :sensor fusion(abstract);分类 cs.RO

Comments 9 pages, 9 figures, This paper is under review of SAE Journal of Connected and Automated Vehicles

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.03563 2025-04-07 cs.CV 57%

PF3Det: A Prompted Foundation Feature Assisted Visual LiDAR 3D Detector

Kaidong Li, Tianxiao Zhang, Kuan-Chuan Peng, Guanghui Wang

专题命中 自动驾驶多传感器融合 :multi-modal fusion(abstract);分类 cs.CV

Comments This paper is accepted to the CVPR 2025 Workshop on Distillation of Foundation Models for Autonomous Driving (WDFM-AD)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.20614 2025-03-27 eess.IV 57%

SaViD: Spectravista Aesthetic Vision Integration for Robust and Discerning 3D Object Detection in Challenging Environments

Tanmoy Dam, Sanjay Bhargav Dharavath, Sameer Alam, Nimrod Lilith, Aniruddha Maiti, Supriyo Chakraborty, Mir Feroskhan

专题命中 自动驾驶多传感器融合 :sensor fusion(abstract);分类 eess.IV

Comments This paper has been accepted for ICRA 2025, and copyright will automatically transfer to IEEE upon its availability on the IEEE portal

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.08092 2025-03-12 cs.CV 57%

SparseVoxFormer: Sparse Voxel-based Transformer for Multi-modal 3D Object Detection

Hyeongseok Son, Jia He, Seung-In Park, Ying Min, Yunhao Zhang, ByungIn Yoo

专题命中 自动驾驶多传感器融合 :multi-modal fusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.00299 2025-03-07 cs.CV 57%

GSPR: Multimodal Place Recognition Using 3D Gaussian Splatting for Autonomous Driving

Zhangshuo Qi, Junyi Ma, Jingyi Xu, Zijie Zhou, Luqi Cheng, Guangming Xiong

专题命中 自动驾驶多传感器融合 :multimodal fusion(abstract);分类 cs.CV

Comments 8 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.03689 2025-03-06 cs.CV 57%

DualDiff+: Dual-Branch Diffusion for High-Fidelity Video Generation with Reward Guidance

Zhao Yang, Zezhong Qian, Xiaofan Li, Weixiang Xu, Gongpeng Zhao, Ruohong Yu, Lingsi Zhu, Longjun Liu

专题命中 自动驾驶多传感器融合 :multimodal fusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.20111 2025-02-28 cs.CV cs.AI 57%

MITracker: Multi-View Integration for Visual Object Tracking

Mengjie Xu, Yitao Zhu, Haotian Jiang, Jiaming Li, Zhenrong Shen, Sheng Wang, Haolin Huang, Xinyu Wang, Qing Yang, Han Zhang, Qian Wang

专题命中 自动驾驶多传感器融合 :information fusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.05075 2025-02-24 cs.CV 57%

DeepInteraction++: Multi-Modality Interaction for Autonomous Driving

Zeyu Yang, Nan Song, Wei Li, Xiatian Zhu, Li Zhang, Philip H. S. Torr

专题命中 自动驾驶多传感器融合 :multi-modal fusion(abstract);分类 cs.CV

Comments Journal extension of NeurIPS 2022. arXiv admin note: text overlap with arXiv:2208.11112

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.05847 2025-02-14 cs.RO cs.AI 57%

Federated Data-Driven Kalman Filtering for State Estimation

Nikos Piperigkos, Alexandros Gkillas, Christos Anagnostopoulos, Aris S. Lalos

专题命中 自动驾驶多传感器融合 :sensor fusion(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏