arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-07-17 至 2026-07-17 共收录 7 信号源:cs.CV, cs.GR, cs.RO

1. 点云 7 篇

2607.14639 2026-07-17 cs.RO cs.CV 新提交 81%

Image-to-Point Cloud Registration Made Easy with Rectified Flow-based LiDAR Upsampling

基于整流流的激光雷达上采样实现图像到点云配准简化

Reon Tabata, Kenji Koide, Shuji Oishi, Masashi Yokozuka, Taku Okawara, Aoki Takanose, Jun Miura

机构 * Department of Computer Science and Engineering, Toyohashi University of Technology(丰桥技术科学大学计算机科学与工程系) National Institute of Advanced Industrial Science and Technology(国立先进工业科学技术研究所)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV、cs.RO

AI总结 研究图像到点云配准难题,提出将激光雷达视为成像传感器的方法,通过条件整流流、特征匹配等步骤估计位姿,经自监督预训练和少量数据微调,实现高精度快速配准,性能优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14946 2026-07-17 cs.CV 新提交 79%

DINE: Distance Is Not Enough -- Learning Global Deformation Priors for Robust Soft-Tissue Point Cloud Registration

DINE:距离并不够——学习用于鲁棒软组织点云配准的全局变形先验

Sara Monji-Azad, Rohit Beer, Marvin Kinz, Claudia Scherl, Jürgen Hesser

机构 * Mannheim Institute for Intelligent Systems in Medicine (MIISM), Medical Faculty Mannheim, Heidelberg University(曼海姆医学智能系统研究所(MIISM),海德堡大学曼海姆医学院) Department of Radiation Oncology, Brigham and Women’s Hospital, Dana-Farber Cancer Institute, Harvard Medical School(布莱根妇女医院放射肿瘤学系,达纳-法伯癌症研究所,哈佛医学院) Department of Otorhinolaryngology, Head and Neck Surgery, University Medical Center Mannheim, Medical Faculty Mannheim, Heidelberg University(海德堡大学曼海姆医学院曼海姆大学医学中心耳鼻咽喉头颈外科) Department of Otolaryngology, Head and Neck Surgery, Campus Klinikum Bielefeld Mitte, University Hospital OWL of Bielefeld University(比勒费尔德大学OWL大学医院比勒费尔德市中心校区耳鼻咽喉头颈外科) Interdisciplinary Center for Scientific Computing (IWR), Heidelberg University(海德堡大学跨学科科学计算中心(IWR)) Central Institute for Computer Engineering (ZITI), Heidelberg University(海德堡大学中央计算机工程研究所(ZITI)) CZS Heidelberg Center for Model-Based AI, Heidelberg University(海德堡大学CZS基于模型的人工智能中心)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 研究针对软组织点云配准中对应估计难题,提出DINE框架,通过学习统计先验增强基于距离的配准,应用于两个主干并采用两阶段策略,实验表明其能降低平均倒角距离,提高对变形和噪声的鲁棒性,凸显全局变形合理性的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14778 2026-07-17 eess.SP 新提交 78%

Conditional Generative Learning Enabled Wireless UAV Sensing and Tracking via Point Cloud Imaging

基于点云成像的条件生成学习实现无线无人机感知与跟踪

Xinhong Dai, Yuan Gao, Hao Jiang, Xiaojun Yuan, Xin Wang

专题命中 点云 :point cloud(title,abstract)

AI总结 研究无人机感知与跟踪问题,提出AUGUST方法,集成条件信道编码与生成解码模块,通过位置和信噪比嵌入及加权训练目标的扩散模型,实现更准确的无人机点云重建与定位,提升对其姿态和形状信息的捕获能力。

Comments 16pages, 13figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13891 2026-07-17 cs.LG cs.CV eess.SP stat.ML 交叉投稿 57%

PiVoT: A Variational Solution for Real-time Large-scale Multi-object Detection and Tracking under Heavy Clutter

PiVoT:一种用于在严重杂波下实时大规模多目标检测与跟踪的变分解决方案

Runze Gan, Qing Li, Simon J. Godsill, Mike E. Davies, James R. Hopgood

机构 * Institute for Imaging, Data and Communications (IDCOM), University of Edinburgh(爱丁堡大学成像、数据与通信研究所(IDCOM)) Department of Engineering, University of Cambridge(剑桥大学工程系) School of Mathematics, University of Edinburgh(爱丁堡大学数学学院)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 针对数据稀缺雷达应用中多目标检测跟踪难题,PiVoT通过联合推断目标多方面信息,无需外部聚类或检测器,利用变分推断创新实现快速抗杂波跟踪,实验证明其在多方面性能出色,优于现有贝叶斯跟踪器。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14839 2026-07-17 cs.CV 版本更新 57%

MapAnything: Evaluating Monocular Metric Depth Models for 3D Urban Asset Localization

MapAnything: 评估单目度量深度模型用于3D城市资产定位

Miriam Louise Carnot, Jonas Kunze, Erik Quinten Fastermann, Eric Peukert, André Ludwig, Bogdan Franczyk

机构 * ScaDS.AI (University of Leipzig)(ScaDS.AI(莱比锡大学)) University of Leipzig(莱比锡大学) Kühne Logistics University(库赫内物流大学) Wrocław University of Economics(沃拉夫经济大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文提出MapAnything框架,通过单目图像自动映射城市物体和事件,利用度量深度估计模型计算物体坐标,验证其在复杂城市环境中的精度,展示其在交通标志和道路损坏等实际应用中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.08068 2026-07-17 cs.CV 版本更新 57%

Simulating Automotive Radar with Lidar and Camera Inputs

利用激光雷达和相机输入模拟汽车雷达

Peili Song, Dezhen Song, Yifan Yang, Enfan Lan, Jingtai Liu

机构 * Institute of Robotics and Automatic Information System, Nankai University(机器人与自动信息系统研究所,南开大学) Tianjin Key Laboratory of Intelligent Robotics(天津智能机器人重点实验室) TBI center, Nankai University(南开大学TBI中心) Department of Robotics, Mohamed Bin Zayed University of Artificial Intelligence (MBZUAI)(人工智能 Mohamed Bin Zayed 大学机器人系)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 研究利用相机图像、激光雷达点云和自身速度模拟汽车雷达信号的方法,基于DIS-Net和RSS-Net两个神经网络,经实验验证能生成高保真信号,用其增强数据训练的目标检测网络性能更优,助力基于雷达的自动驾驶研发。

Comments Accepted by 2025 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14419 2026-07-17 cs.LG cs.CG 新提交 50%

HyperShadow: A Benchmark for Detecting 3D Projections of Higher-Dimensional Spatial Objects

HyperShadow:用于检测高维空间对象3D投影的基准测试

Akshay Sasi

专题命中 点云 :point cloud(abstract)

AI总结 HyperShadow是用于检测高维空间对象3D投影的基准测试,通过190k参数点网络及零参数刚性见证进行检测,能在不同损坏层级达到高准确率和泛化率,为研究三维解释不兼容性提供工具,数据等已公开。

Comments 8 pages, 5 figures. Code: https://github.com/AkshaySasi/hypershadow. Dataset: https://huggingface.co/datasets/AkshaySasi/hypershadow

详情

展开后加载摘要…

URL PDF HTML 收藏