arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

多模态大模型

跨文本、图像、视频、音频等模态的大模型与学习方法。

共收录 4884 信号源:cs.CV, cs.CL, cs.AI, cs.MM, eess.AS

1. 其他多模态 4884 篇

2603.14610 2026-03-18 cs.CV eess.IV 57%

Make it SING: Analyzing Semantic Invariants in Classifiers

使分类器具备语义不变性:分析分类器中的语义不变性

Harel Yadid, Meir Yossef Levi, Roy Betser, Guy Gilboa

机构 * Viterbi Faculty of Electrical and Computer Engineering(电气与计算机工程学院)

专题命中 其他多模态 :multi-modal(abstract);分类 cs.CV

AI总结 本文提出SING方法,通过构建等价图像并赋予语义解释,揭示分类器中语义不变性,分析不同模型在保持语义方面的差异。

Comments Accepted to the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17018 2026-03-18 cs.CV 57%

SophiaVL-R1: Reinforcing MLLMs Reasoning with Thinking Reward

SophiaVL-R1: 通过思考奖励强化大语言模型的推理能力

Kaixuan Fan, Kaituo Feng, Haoming Lyu, Dongzhan Zhou, Xiangyu Yue

机构 * MMLab, The Chinese University of Hong Kong(MMLab,香港中文大学) Shanghai Artifcial Intelligence Laboratory(上海人工智能实验室)

专题命中 其他多模态 :multimodal(abstract);分类 cs.CV

AI总结 SophiaVL-R1通过引入思考奖励信号提升多模态大语言模型的推理能力,采用信任GRPO方法和退火训练策略,有效缓解奖励黑客问题,实验表明其在多个基准测试中表现优异。

Comments ICLR 2026, Project page:https://github.com/kxfan2002/SophiaVL-R1

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15767 2026-03-18 cs.CV 57%

CLRNet: Targetless Extrinsic Calibration for Camera, Lidar and 4D Radar Using Deep Learning

CLRNet:基于深度学习的无目标外校准方法用于摄像头、激光雷达和4D雷达

Marcell Kegl, Andras Palffy, Csaba Benedek, Dariu M. Gavrila

机构 * Hungarian Research Network Institute for Computer Science and Control (HUN-REN SZTAKI)(匈牙利研究网络计算机科学与控制研究所) Pázmány Péter Catholic University(帕兹曼·佩斯特天主教大学) Intelligent Vehicles Group, TU Delft(智能车辆组,代尔夫特理工大学) Perciv AI

专题命中 其他多模态 :multi-modal(abstract);分类 cs.CV

AI总结 本文提出CLRNet,一种多模态端到端深度学习网络,用于摄像头、激光雷达和4D雷达的联合校准或配对校准,通过等距投影、基于摄像头的深度图像预测和雷达通道等方法,提升校准精度。

Comments Submitted to IEEE Transactions on Intelligent Vehicles

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13766 2026-03-17 cs.CV 57%

LHM++: An Efficient Large Human Reconstruction Model for Pose-free Images to 3D

LHM++:一种高效的大型人类重建模型,用于从无姿态图像到3D

Lingteng Qiu, Peihao Li, Heyuan Li, Qi Zuo, Xiaodong Gu, Yuan Dong, Weihao Yuan, Rui Peng, Siyu Zhu, Xiaoguang Han, Guanying Chen, Zilong Dong

专题命中 其他多模态 :multimodal(abstract);分类 cs.CV

AI总结 本文提出LHM++模型,通过编码器-解码器点图像变换器高效生成高质量可动画3D人像,融合多模态注意力提升效率与视觉真实性。

Comments HomePage: https://lingtengqiu.github.io/LHM++/ Online Demo: https://huggingface.co/spaces/Lingteng/LHMPP

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12117 2026-03-17 cs.LG cs.AI 57%

KAN-FIF: Spline-Parameterized Lightweight Physics-based Tropical Cyclone Estimation on Meteorological Satellite

KAN-FIF: 基于样条参数化的轻量级物理引导型热带气旋估计方法用于气象卫星

Jiakang Shen, Qinghui Chen, Runtong Wang, Chenrui Xu, Jinglin Zhang, Cong Bai, Feng Zhang

专题命中 其他多模态 :multimodal(abstract);分类 cs.AI

AI总结 本文提出KAN-FIF框架,通过整合MLP和CNN层与样条参数化的KAN层,实现轻量级多模态架构,在减少参数量和提升推理速度的同时保持高精度,适用于边缘设备的热带气旋监测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11316 2026-03-13 physics.med-ph cs.CV cs.LG 57%

MRI2Qmap: multi-parametric quantitative mapping with MRI-driven denoising priors

MRI2Qmap: 多参数定量成像与MRI驱动去噪先验

Mohammad Golbabaee, Matteo Cencini, Carolin Pirkl, Marion Menzel, Michela Tosetti, Bjoern Menze

专题命中 其他多模态 :multimodal(abstract);分类 cs.CV

AI总结 MRI2Qmap通过整合物理模型与深度学习先验,实现无需地面真实数据的高效定量MRI重建,提升高加速成像性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09206 2026-03-11 cs.CV cs.LG 57%

MM-Zero: Self-Evolving Multi-Model Vision Language Models From Zero Data

MM-Zero: 从零数据自我进化多模型视觉语言模型

Zongxia Li, Hongyang Du, Chengsong Huang, Xiyang Wu, Lantao Yu, Yicheng He, Jing Xie, Xiaomin Wu, Zhichao Liu, Jiarui Zhang, Fuxiao Liu

机构 * University of Maryland(马里兰大学) Brown University(布朗大学) Washington University in St. Louis(圣路易斯华盛顿大学) Adobe University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) University of Southern California(南加州大学) NVIDIA

专题命中 其他多模态 :multimodal(abstract);分类 cs.CV

AI总结 MM-Zero通过多角色框架实现VLM零数据自我进化,提升多模态推理性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22712 2026-03-10 cs.GR cs.AI 57%

Step2Motion: Locomotion Reconstruction from Pressure Sensing Insoles

Step2Motion: 从压力传感鞋垫重建运动

Jose Luis Ponton, Eduardo Alvarado, Lin Geng Foo, Nuria Pelechano, Carlos Andujar, Marc Habermann

机构 * Universitat Politècnica de Catalunya(巴塞罗那理工大学) Max Planck Institute for Informatics(马克斯·普朗克研究所(信息学))

专题命中 其他多模态 :multi-modal(abstract);分类 cs.AI

AI总结 Step2Motion通过多模态鞋垫传感器重建人类运动,提供了一种无约束、不受视距限制的运动捕捉方法。

Comments Eurographics 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07295 2026-03-10 cs.AI 57%

A Cortically Inspired Architecture for Modular Perceptual AI

一种模块化感知人工智能的皮层启发架构

Prerna Luthra

机构 * Independent Researcher(独立研究者)

专题命中 其他多模态 :cross-modal(abstract);分类 cs.AI

AI总结 本文提出了一种受皮层启发的模块化感知人工智能架构,通过分解感知为专门模块,提升可解释性和推理透明度。

Comments Accepted to the ICLR 2026 Workshop on "From Human Cognition to AI Reasoning: Models, Methods, and Applications (HCAIR)"

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03579 2026-03-05 cs.NI cs.CV 57%

Spectrum Shortage for Radio Sensing? Leveraging Ambient 5G Signals for Human Activity Detection

无线电感知短缺?利用环境5G信号进行人体活动检测

Kunzhe Song, Maxime Zingraff, Huacheng Zeng

机构 * Department of Computer Science and Engineering, Michigan State University, USA(计算机科学与工程系,密歇根州立大学)

专题命中 其他多模态 :cross-modal(abstract);分类 cs.CV

AI总结 本文提出环境无线电感知(ARS)方法,利用现有无线系统信号解决频谱短缺问题,通过跨模态学习框架实现人体活动识别,展示了准确的骨骼估计和遮挡分割应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14686 2026-03-04 cs.DC cs.AI 57%

xLLM Technical Report

xLLM 技术报告

Tongxuan Liu, Tao Peng, Peijun Yang, Xiaoyang Zhao, Xiusheng Lu, Weizhe Huang, Zirui Liu, Xiaoyu Chen, Zhiwei Liang, Jun Xiong, Donghe Jin, Minchao Zhang, Jinrong Guo, Yingxu Deng, Xu Zhang, Xianzhe Dong, Siqi Wang, Siyu Wu, Yu Wu, Zihan Tang, Yuting Zeng, Yanshu Wang, Jinguang Liu, Meng Kang, Menxin Li, Yunlong Wang, Yiming Liu, Xiaolong Ma, Yifan Wang, Yichen Zhang, Jinrun Yin, Keyang Zheng, Jiawei Yin, Jun Zhang, Ziyue Wang, Xiaobo Lin, Liangyu Liu, Liwei Lan, Yang Liu, Chunhua Peng, Han Liu, Songcheng Ren, Xuezhu Wang, Yunheng Shen, Yi Wang, Guyue Liu, Yitao Hu, Hui Chen, Tong Yang, Hailong Yang, Jing Li, Guiguang Ding, Ke Zhang

机构 * THU(清华大学) USTC(University of Science and Technology of China) BUAA(Beijing University of Aeronautics and Automation) PKU(Peking University) TJU(Tianjin University)

专题命中 其他多模态 :multimodal(abstract);分类 cs.AI

AI总结 xLLM是一种针对高性能大规模企业级服务设计的高效LLM推理框架,通过解耦服务引擎架构和多层优化提升吞吐量和推理效率。

Comments 39 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01948 2026-03-03 cs.CV 57%

PreSight: Preoperative Outcome Prediction for Parkinson's Disease via Region-Prior Morphometry and Patient-Specific Weighting

PreSight:通过区域先验形态学和患者特异性加权进行帕金森病术前预后预测

Yand Wang, Chen Zhang, Lanyun Zhu, Yixin Chen, Qunbo Wang, Yutong Bai, Jurgen Germann, Yinghong Wen, Shuai Shao

机构 * Beijing Jiaotong University(北京交通大学) Nanyang Technological University(南洋理工大学) Institute of Medical Technology, Peking University(北京大学医学技术研究院) Beijing Tiantan Hospital, Capital Medical University(北京天坛医院) University Health Network, University of Toronto(多伦多大学健康网络) Suzhou Institute for Advanced Research, University of Science and Technology of China(中国科学技术大学苏州研究院)

专题命中 其他多模态 :multimodal(abstract);分类 cs.CV

AI总结 PreSight通过结合临床先验与区域自适应形态学,实现帕金森病术前预后预测,提升术后运动改善预测的准确性和临床实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23348 2026-03-03 cs.RO cs.CV 57%

Physically Ground Commonsense Knowledge for Articulated Object Manipulation with Analytic Concepts

为拟合物体操纵的物理常识知识而引入分析概念

Jiude Wei, Yuxuan Li, Cewu Lu, Jianhua Sun

机构 * School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院) School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机学院) Shanghai Innovation Institute(上海创新研究院)

专题命中 其他多模态 :multi-modal(abstract);分类 cs.CV

AI总结 本文提出通过引入分析概念,将语义级常识知识接地到物理世界,以提升机器人对关节物体的通用精确操纵能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.04490 2026-03-03 cs.CL q-bio.GN 57%

Large Language Models in Bioinformatics: A Survey

大语言模型在生物信息学中的应用:综述

Zhenyu Wang, Zikang Wang, Jiyue Jiang, Pengan Chen, Xiangyu Shi, Yu Li

机构 * The Chinese University of Hong Kong(香港中文大学) Peking University Third Hospital(北京大学第三医院) The Hong Kong Polytechnic University(香港理工大学) The University of Hong Kong(香港大学)

专题命中 其他多模态 :multimodal(abstract);分类 cs.CL

AI总结 本文综述了大语言模型在生物信息学中的应用,涵盖基因组序列建模、RNA结构预测等核心方法,并探讨了数据稀缺和跨组学整合等挑战及未来发展方向。

Comments Accepted by ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01026 2026-03-03 cs.CV 57%

RaUF: Learning the Spatial Uncertainty Field of Radar

RaUF: 学习雷达的时空不确定性场

Shengpeng Wang, Kuangyu Wang, Wei Wang

机构 * Huazhong University of Science and Technology(华中科技大学) Wuhan University(武汉大学)

专题命中 其他多模态 :cross-modal(abstract);分类 cs.CV

AI总结 RaUF通过学习雷达测量的各向异性特性,解决方位模糊和虚假回波问题,提升空间检测的可靠性与不确定性校准。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00988 2026-03-03 cs.CV cs.SE 57%

Foundation Models in Remote Sensing: Evolving from Unimodality to Multimodality

遥感中的基础模型:从单模态到多模态的演变

Danfeng Hong, Chenyu Li, Xuyang Li, Gustau Camps-Valls, Jocelyn Chanussot

机构 * School of Automation, Southeast University(自动化学院,东南大学) School of Mathematics, Southeast University(数学学院,东南大学) Aerospace Information Research Institute, Chinese Academy of Sciences(航天信息研究所,中国科学院) Image Processing Laboratory (IPL), Universitat de València(图像处理实验室(IPL),瓦伦西亚大学) Univ. Grenoble Alpes, INRIA, CNRS, Grenoble INP, LJK(格勒诺布尔阿尔卑斯大学,INRIA,CNRS,格勒诺布尔INP,LJK)

专题命中 其他多模态 :multimodal(abstract);分类 cs.CV

AI总结 本文探讨了遥感中基础模型从单模态到多模态的演变,旨在为研究人员提供深入理解与应用指导。

Comments Accepted by IEEE GRSM

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00436 2026-03-03 cs.LG cs.AI 57%

ROKA: Robust Knowledge Unlearning against Adversaries

ROKA: 面对对抗者的鲁棒知识反学习

Jinmyeong Shin, Joshua Tapia, Nicholas Ferreira, Gabriel Diaz, Moayed Daneshyari, Hyeran Jeon

机构 * University of California, Merced(加州大学梅尔塞德斯分校) California State University, East Bay(加州州立大学东湾分校)

专题命中 其他多模态 :multi-modal(abstract);分类 cs.AI

AI总结 ROKA通过神经愈合机制实现鲁棒的知识反学习,有效对抗间接反学习攻击,同时保护保留数据的准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21042 2026-02-25 cs.CV 57%

OmniOCR: Generalist OCR for Ethnic Minority Languages

OmniOCR:面向少数民族语言的通用OCR

Bonan Liu, Zeyu Zhang, Bingbing Meng, Han Wang, Hanshuo Zhang, Chengping Wang, Daji Ergu, Ying Cai

机构 * Southwest Minzu University(西南民族大学) AI Geeks

专题命中 其他多模态 :multimodal(abstract);分类 cs.CV

AI总结 OmniOCR通过动态LoRA和稀疏正则化技术,实现了对少数民族语言的高效OCR识别,显著提升了低资源和零样本场景下的准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18470 2026-02-25 cs.CY cs.AI 57%

Transforming Science Learning Materials in the Era of Artificial Intelligence

人工智能时代科学学习材料的变革

Xiaoming Zhai, Kent Crippen

专题命中 其他多模态 :multimodal(abstract);分类 cs.AI

AI总结 本文探讨了人工智能在科学教育中如何变革学习材料,通过六个领域展示AI对个性化教学、互动模拟和多模态内容生成的影响,并强调伦理和教育价值的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06292 2026-02-24 eess.IV cs.CV 57%

Zero-shot Multi-Contrast Brain MRI Registration by Intensity Randomizing T1-weighted MRI (LUMIR25)

无监督多对比脑MRI配准:通过强度随机化T1加权MRI(LUMIR25)

Hengjie Liu, Yimeng Dou, Di Xu, Xinyi Fu, Dan Ruan, Ke Sheng

专题命中 其他多模态 :multimodal(abstract);分类 cs.CV

AI总结 本文提出了一种基于强度随机化的多对比度脑MRI配准方法,通过多模态损失、强度随机化和轻量级优化策略,在无需显式图像合成的情况下实现了跨对比度的稳健泛化。

Comments Submitted to and reviewed by Learn2Reg MICCAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17250 2026-02-20 cs.CV 57%

Inferring Height from Earth Embeddings: First insights using Google AlphaEarth

从地球嵌入推断高度:使用谷歌AlphaEarth的初步见解

Alireza Hamoudzadeh, Valeria Belloni, Roberta Ravanelli

机构 * Geodesy and Geomatics Division, DICEA, Sapienza University of Rome(罗马大学地球科学与测绘学系) Geomatics Unit, Department of Geography, Faculty of Sciences, University of Liège(列日大学科学学院地理系)

专题命中 其他多模态 :multimodal(abstract);分类 cs.CV

AI总结 本研究利用AlphaEarth嵌入和U-Net++架构,验证了其在指导深度学习进行地形高度制图中的有效性,并发现其在应对分布偏移时表现更优。

Comments 29 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05687 2026-02-16 cs.HC cs.AI 57%

Exploring AI-Augmented Sensemaking of Patient-Generated Health Data: A Mixed-Method Study with Healthcare Professionals in Cardiac Risk Reduction

探索人工智能增强的患者生成健康数据理解:一项结合定性与定量方法的医疗专业人员研究,用于心脏风险降低

Pavithren V S Pakianathan, Rania Islambouli, Diogo Branco, Albrecht Schmidt, Tiago Guerreiro, Jan David Smeddinck

机构 * Ludwig Boltzmann Institute for Digital Health and Prevention(数字健康与预防路德维希·玻尔兹曼研究所)

专题命中 其他多模态 :multimodal(abstract);分类 cs.AI

AI总结 本文探讨了大型语言模型如何通过自动摘要和对话界面支持医疗专业人员理解患者生成的健康数据,以提高心脏疾病风险降低的临床决策。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11142 2026-02-12 cs.RO cs.AI cs.LG 57%

Data-Efficient Hierarchical Goal-Conditioned Reinforcement Learning via Normalizing Flows

通过归一化流实现数据高效的分层目标条件强化学习

Shaswat Garg, Matin Moezzi, Brandon Da Silva

机构 * ArenaX Labs(ArenaX实验室)

专题命中 其他多模态 :multimodal(abstract);分类 cs.AI

AI总结 本文提出基于归一化流的分层隐式Q学习框架,通过提升策略表达能力与数据效率,实现更稳健的长周期任务学习。

Comments 9 pages, 3 figures, IEEE International Conference on Robotics and Automation 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24716 2026-02-12 cs.LG cs.AI cs.RO 57%

Discrete Variational Autoencoding via Policy Search

通过策略搜索进行离散变分自编码

Michael Drolet, Firas Al-Hafez, Aditya Bhatt, Jan Peters, Oleg Arenz

专题命中 其他多模态 :multimodal(abstract);分类 cs.AI

AI总结 本文提出了一种基于策略搜索的离散VAE训练框架,利用非参数编码器的自然梯度提升编码器性能,实现高效高维数据重建。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09278 2026-02-11 cs.CV cs.LG cs.RO 57%

UFM: A Simple Path towards Unified Dense Correspondence with Flow

UFM: 一种通往统一密集对应关系的简单路径:流

Yuchen Zhang, Nikhil Keetha, Chenwei Lyu, Bhuvan Jhamb, Yutian Chen, Yuheng Qiu, Jay Karhade, Shreyas Jha, Yaoyu Hu, Deva Ramanan, Sebastian Scherer, Wenshan Wang

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 其他多模态 :multi-modal(abstract);分类 cs.CV

AI总结 UFM通过统一训练方法在密集对应关系任务中实现了更高的准确性和效率,优于专门方法。

Comments Project Page: https://uniflowmatch.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08019 2026-02-10 cs.LG cs.AI 57%

The Rise of Sparse Mixture-of-Experts: A Survey from Algorithmic Foundations to Decentralized Architectures and Vertical Domain Applications

稀疏专家混合模型的兴起:从算法基础到去中心化架构和垂直领域应用的综述

Dong Pan, Bingtao Li, Yongsheng Zheng, Jiren Ma, Victor Fei

机构 * FEDIMOSS TECH HK LIMITED(FEDIMOSS科技(香港)有限公司) Ormi Labs, Inc.(Ormi实验室有限公司)

专题命中 其他多模态 :multimodal(abstract);分类 cs.AI

AI总结 本文综述了稀疏混合专家模型从算法基础到去中心化架构及垂直领域应用的发展,系统探讨了其核心原理、去中心化范式和关键挑战,为研究者和实践者提供全面的参考。

Journal ref Journal of Computer Science and Artificial Intelligence 5 (2025) 25-41

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08619 2026-02-10 cs.NE cs.AI cs.LG 57%

Enhancing Genetic Algorithms with Graph Neural Networks: A Timetabling Case Study

用图神经网络增强遗传算法:一个排程案例研究

Laura-Maria Cornei, Mihaela-Elena Breabăn

机构 * Alexandru Ioan Cuza University, Faculty of Computer Science(阿历山大·伊奥安·库扎大学计算机科学学院)

专题命中 其他多模态 :multi-modal(abstract);分类 cs.AI

AI总结 本文提出将图神经网络与遗传算法结合用于排程优化,通过实验验证了混合方法在时间和解决方案质量上的优势。

Comments Paper accepted to the International Conference on Applications of Evolutionary Computation (EvoApplications) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07089 2026-02-10 cs.MM cs.CY cs.SI 57%

Stickers on Facebook: Multifunctionality and face-enhancing politeness in everyday social interaction

Facebook上的贴纸:日常社交互动中的多功能性与面子增强的礼貌

Laura M. Porrino-Moscoso

专题命中 其他多模态 :multimodal(abstract);分类 cs.MM

AI总结 本研究分析了疫情期间Facebook评论中贴纸的使用,揭示其在增强礼貌和情感交流中的多功能性及性别差异。

Comments in Spanish language, Stickers en Facebook: multifuncionalidad y cortesía valorizante en la interacción social cotidiana, Oralia: Análisis del Discurso Oral, 30 (1)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03949 2026-02-05 cs.IT cs.AI cs.LG math.IT 57%

Semantic Rate Distortion and Posterior Design: Compute Constraints, Multimodality, and Strategic Inference

语义速率与后验设计:计算限制、多模态与战略推断

Emrah Akyol

机构 * Electrical and Computer Engineering Department, Binghamton University(宾夕法尼亚大学布林茅尔分校电子与计算机工程系)

专题命中 其他多模态 :multimodal(abstract);分类 cs.AI

AI总结 本文研究了在计算限制下的语义压缩问题,通过后验设计和多模态观测优化,提高了语义准确性和模型效率。

Comments submitted for publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03908 2026-02-05 cs.RO cs.CV 57%

Beyond the Vehicle: Cooperative Localization by Fusing Point Clouds for GPS-Challenged Urban Scenarios

超越车辆:通过融合点云进行协作定位以应对GPS挑战的都市场景

Kuo-Yi Chao, Ralph Rasshofer, Alois Christian Knoll

机构 * Technical University of Munich(慕尼黑技术大学) BMW Group(宝马集团)

专题命中 其他多模态 :multi-modal(abstract);分类 cs.CV

AI总结 本文提出一种融合点云的协作定位方法,通过多传感器和多模态数据提升GPS不可靠城市环境中的定位精度和鲁棒性。

Comments 8 pages, 2 figures, Driving the Future Symposium 2025

详情

展开后加载摘要…

URL PDF HTML 收藏