arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-05-26 至 2026-05-26 共收录 23 信号源:cs.CV, cs.GR, cs.RO

1. 点云 23 篇

2605.25921 2026-05-26 cs.GR cs.CV 81%

Curve Skeletonization in Continuous domain for Meshes and Point Clouds

网格与点云的连续域曲线骨架化

Jai Bardhan, Ramya Hebbalaguppe, Aravind Udupa

机构 * TCS Research(TCS研究) IIT Delhi(德里理工学院)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV、cs.GR

AI总结 提出CSCD框架,将基于局部分隔符的骨架化方法推广到连续域,通过CSCD-M(网格)和CSCD-PC(点云)两种实现,提升了骨架提取的鲁棒性和拓扑保持能力。

Comments 31 pages, 26 figures, 7 tables, 4 algorithms. Published at IEEE/CVF Winter Conference on Applications of Computer Vision (WACV) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25503 2026-05-26 cs.CV 79%

Metric--Phase Fields: Decoupling Distance and Sign for Thin-Structure Reconstruction from Unoriented Point Clouds

度量-相位场:从无定向点云中解耦距离和符号以重建薄结构

Jiayi Kong, Xuhui Chen, Chen Zong, Fei Hou, Junhui Hou, Wenping Wang, Ying He

机构 * S-Lab, Nanyang Technological University, Singapore Key Laboratory of System Software (CAS), Institute of Software, Chinese Academy of Sciences, China University of Chinese Academy of Sciences, China School of Mathematics, Nanjing University of Aeronautics Department of Computer Science, City University of Hong Kong, Hong Kong SAR, China Department of Computer Science Engineering, Texas A\&M University, USA

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 提出度量-相位场(MPF),通过解耦度量距离和拓扑相位,结合门控度量公式和残差相位注入,实现从无定向点云中稳定重建薄结构和开放边界。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25216 2026-05-26 cs.RO 79%

InvariantCloud: A Globally Invariant, Uniquely Indexed Point Cloud Framework for Robust 6-DoF Tactile Pose Tracking

InvariantCloud:一种全局不变、唯一索引的点云框架,用于鲁棒的6自由度触觉姿态跟踪

Pengfei Ye, Yuxiang Ma, Yi Zhou, Wei Chen, Wenzhen Dong, Molong Duan

机构 * Department of Mechanical and Aerospace Engineering, The Hong Kong University of Science and Technology(香港科学与技术大学机械与航空航天工程系) Department of Mechanical Engineering, Massachusetts Institute of Technology(麻省理工学院机械工程系) Department of Mechanical and Automation Engineering, The Chinese University of Hong Kong(香港中文大学机械与自动化工程系)

专题命中 点云 :point cloud(title,abstract);分类 cs.RO

AI总结 提出InvariantCloud框架,利用视觉触觉传感器上表面标记星座的全局不变性,通过一次性全局不变点云配准实现6自由度物体姿态估计,抑制累积漂移并准确估计偏航旋转,在长序列操作任务中展现出高精度和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25127 2026-05-26 cs.CV cs.LG 79%

PQDT: Pseudo-Query Dual Transformer for Robust Point Cloud Restoration

PQDT: 伪查询双Transformer用于鲁棒点云修复

Haoqing Wu, Alexa Nawotki, Jochen Garcke

机构 * Mercedes-Benz AG(梅赛德斯-奔驰集团) University of Bonn(波恩大学) Fraunhofer SCAI(弗劳恩霍夫SCAI研究所)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 提出一种基于伪查询模块和Transformer主干网络的统一3D修复网络,通过两阶段几何变换增强结构清晰度和局部细节,在多种退化场景下超越现有方法。

Comments To be published in The IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24753 2026-05-26 cs.CV 79%

Ghosts in the Point Clouds: De-glaring LiDAR in the Transient Domain

点云中的鬼影:瞬态域中的LiDAR去眩光

Avery Gump, Connor Henley, Sungjin Cheong, Akarsh Prabhakara, Mohit Gupta

机构 * University of Wisconsin–Madison(威斯康星大学麦迪逊分校)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 针对固态LiDAR内部多径眩光导致的伪影问题,提出基于瞬态眩光扩散函数(TGSF)的物理模型和无训练算法,在点云形成前抑制眩光,保留真实场景结构。

Comments CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23670 2026-05-26 cs.CV 79%

Learning Bijective Surface Parameterization for Inferring Signed Distance Functions from Sparse Point Clouds with Grid Deformation

学习双射曲面参数化以通过网格变形从稀疏点云推断符号距离函数

Takeshi Noda, Chao Chen, Junsheng Zhou, Weiqi Zhang, Yu-Shen Liu, Zhizhong Han

机构 * School of Software, Tsinghua University, Beijing, China(清华大学软件学院,北京,中国) Department of Computer Science, Wayne State University, Detroit, USA(韦恩州立大学计算机科学系,底特律,美国)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 提出一种动态变形网络结合双射曲面参数化和网格变形优化的方法,从稀疏点云端到端预测符号距离函数,显著优于现有方法。

Comments Accepted by Conference on Computer Vision and Pattern Recognition (CVPR) 2025. Project page:https://takeshie.github.io/Bijective-SDF

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24390 2026-05-26 cs.LG 78%

Learning Laplacian Eigenspace with Mass-Aware Neural Operators on Point Clouds

学习拉普拉斯特征空间:基于质量感知神经算子的点云处理

Zherui Yang, Tao Du, Ligang Liu

机构 * University of Science and Technology of China(中国科学技术大学) Tsinghua University(清华大学) Shanghai Qi Zhi Institute(上海智院) Laoshan Laboratory(崂山实验室)

专题命中 点云 :point cloud(title,abstract)

AI总结 提出神经特征空间算子(NEO),通过预测稳定不变的低频子空间而非特征向量,结合质量感知神经算子和瑞利-里兹精化,实现点云上拉普拉斯-贝尔特拉米算子的快速谱分解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25279 2026-05-26 cs.RO 74%

GreenSeg: Ground Segmentation Algorithm for Agricultural Robots in Mediterranean Greenhouses using RGB-D Point Clouds

GreenSeg: 基于RGB-D点云的地中海温室农业机器人地面分割算法

Fernando Cañadas-Aránega, José C. Moreno, José L. Blanco-Claraco

机构 * Department of Informatics, CIESOL, ceiA3, Universidad de Almería(信息学院,CIESOL,ceiA3,阿尔梅里亚大学)

专题命中 点云 :point cloud(title);分类 cs.RO

AI总结 针对地中海温室狭窄通道、异构地形和光学干扰等挑战,提出一种基于RGB-D感知的双层验证地面分割框架GreenSeg,通过全局平面拟合、曲率滤波和种子点区域生长实现稳定导航,在AGRICOBIOT I平台上验证了其在动态光照下优于基准方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25334 2026-05-26 cs.CV 70%

Dual-Pathway Geometry-Aware MLLM for Spatial Intelligence

双路径几何感知多模态大语言模型用于空间智能

Yufei Zheng, Xuhan Zhu, Zide Liu, Chunpeng Zhou, Chenfeng Wang, Yongchao Xu, Yunnan Wang, Jiawei Liu, Pengfei Yu, Wei Zhai, Yang Cao, Zheng-Jun Zha

机构 * University of Science and Technology of China(中国科学技术大学) Li Auto Inc.(利汽车公司) Shanghai Jiao Tong University(上海交通大学)

专题命中 点云 :point cloud(abstract);spatial understanding(abstract);分类 cs.CV

AI总结 提出GAMSI,一种仅以RGB图像为输入、通过双路径查询和专家引导视觉对齐实现3D结构与度量尺度联合感知的多模态大语言模型,在七个空间智能基准上达到最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24331 2026-05-26 cs.CV 70%

Spatial-aware Vision Language Model for Autonomous Driving

面向自动驾驶的空间感知视觉语言模型

Weijie Wei, Zhipeng Luo, Ling Feng, Venice Erin Liong

机构 * Motional University of Amsterdam(阿姆斯特丹大学)

专题命中 点云 :point cloud(abstract);spatial understanding(abstract);分类 cs.CV

AI总结 提出LVLDrive框架,通过融合LiDAR点云与视觉语言模型,利用渐进融合Q-Former和空间感知问答数据集,解决3D度量空间推理瓶颈,提升自动驾驶场景理解与决策可靠性。

Comments Accepted to CVPR AutoPilot Workshop 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22809 2026-05-26 cs.CV 70%

Sensor2Sensor: Cross-Embodiment Sensor Conversion for Autonomous Driving

Sensor2Sensor: 自动驾驶的跨本体传感器转换

Jiahao Wang, Bo Sun, Yijing Bai, Vincent Casser, Songyou Peng, Zehao Zhu, Meng-Li Shih, Xander Masotto, Shih-Yang Su, Kanaad V Parvate, Tiancheng Ge, Linn Bieske, Dragomir Anguelov, Mingxing Tan, Chiyu Max Jiang

机构 * Waymo Johns Hopkins University(约翰霍普金斯大学) Google DeepMind(谷歌DeepMind) University of Washington(华盛顿大学)

专题命中 点云 :Gaussian Splatting(abstract);point cloud(abstract);分类 cs.CV

AI总结 提出Sensor2Sensor生成模型,将单目行车记录仪视频转换为多模态传感器数据(多视角相机图像和LiDAR点云),通过4D高斯泼溅重建和扩散架构解决无配对数据问题,为自动驾驶开发解锁外部数据源。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22973 2026-05-26 cs.CV 70%

Scaling Up Occupancy-centric Driving Scene Generation: Dataset and Method

扩展以占据为中心的驾驶场景生成:数据集与方法

Bohan Li, Xin Jin, Hu Zhu, Hongsi Liu, Ruikai Li, Jiazhe Guo, Kaiwen Cai, Chao Ma, Yueming Jin, Hao Zhao, Xiaokang Yang, Wenjun Zeng

机构 * Shanghai Jiao Tong University(上海交通大学) Eastern Institute of Technology(东部技术研究院) School of Electronic Information and Electrical Engineering(电子信息与电气工程学院) Li Auto(力汽车) National University of Singapore(新加坡国立大学) Tsinghua University(清华大学) Ningbo Key Laboratory of Spatial Intelligence and Digital Derivative(宁波空间智能与数字衍生实验室) Ningbo Institute of Digital Twin(宁波数字孪生研究院)

专题命中 点云 :Gaussian Splatting(abstract);point cloud(abstract);分类 cs.CV

AI总结 针对占据数据稀缺问题,构建最大语义占据数据集Nuplan-Occ,并提出统一框架联合生成高质量语义占据、多视角视频和LiDAR点云,采用时空解耦架构及高斯泼溅稀疏点图渲染和传感器感知嵌入策略,实现高保真生成。

Comments IEEE TPAMI

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25901 2026-05-26 cs.CV cs.RO 62%

AgentGrounder: Zero-Shot 3D Visual Pointcloud Grounding using Multimodal Language Models

AgentGrounder:使用多模态语言模型的零样本3D视觉点云定位

Cuong Huynh, Maxim Popov, Denis Gridusov, Sergey Kolyubin

机构 * Biomechatronics and Energy-Efficient Robotics (BE2R) Lab, ITMO University(生物机械与高效能机器人实验室,ITMO大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV、cs.RO

AI总结 提出AgentGrounder框架,通过两阶段设计(离线构建对象查找表和在线工具驱动代理)实现零样本3D视觉定位,在ScanRefer和Nr3D上分别提升2.5%和6.3%的准确率。

Comments Code: https://github.com/be2rlab/AgentGrounder

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25553 2026-05-26 cs.CV cs.RO 62%

ComPose: A Unified Completion-Pose Framework for Robust Category-Level Object Pose Estimation

ComPose:用于鲁棒类别级物体姿态估计的统一补全-姿态框架

Huan Ren, Yihan Chen, Chuxin Wang, Nailong Liu, Wenfei Yang, Tianzhu Zhang

机构 * University of Science and Technology of China(中国科学技术大学) National Key Laboratory of Deep Space Exploration, Deep Space Exploration Laboratory(国家空间科学探测重点实验室,深空探测实验室) Beijing Institute of Control Engineering(北京控制工程研究所)

专题命中 点云 :point cloud(abstract);分类 cs.CV、cs.RO

AI总结 提出ComPose框架,通过关键点渐进补全模块和几何关系一致性损失,将形状补全与姿态估计紧密集成,在不依赖类别级形状先验的情况下提升点云不完整场景下的姿态估计精度和效率。

Comments Accepted by CVPR 2026 (Oral, Best Paper Award Candidate). Project page is available at renhuan1999.github.io/ComPose

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25293 2026-05-26 cs.CV cs.AI cs.RO 62%

Neuromorphic LiDAR-based Bird's Eye View Object Detection using Energy-efficient Spiking Neural Networks

基于神经形态激光雷达的鸟瞰图目标检测:使用节能脉冲神经网络

Sambit Mohapatra, Senthil Yogamani, Heinrich Gotzig, Patrick Mader

机构 * Valeo, Germany(德国瓦莱欧公司) Valeo, Ireland(爱尔兰瓦莱欧公司) TU Ilmenau, Germany(德国伊门豪大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV、cs.RO

AI总结 提出一种端到端脉冲编码器-解码器网络,用于激光雷达点云鸟瞰图表示中的目标检测,通过代理梯度反向传播训练,在KITTI基准上达到高精度,并实现3.33倍突触操作能耗降低。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07607 2026-05-26 cs.CV 57%

FS-I2P:A Hierarchical Focus-Sweep Registration Network with Dynamically Allocated Depth

FS-I2P:一种具有动态分配深度的分层聚焦扫描配准网络

Zhixin Cheng, Yujia Chen, Xujing Tao, Bohao Liao, Xiaotian Yin, Baoqun Yin, Tianzhu Zhang

机构 * School of Information Science and Technology, University of Science and Technology of China(信息科学与技术学院,中国科学技术大学) School of Computer Science and Information Engineering, Hefei University of Technology(计算机科学与信息工程学院,合肥工业大学) National Key Laboratory of Deep Space Exploration, Deep Space Exploration Laboratory(深空探测国家实验室,深空探测实验室) Institute of Advanced Technology, University of Science and Technology of China(先进技术研究院,中国科学技术大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 提出一种基于聚焦-扫描范式的分层交互模块和动态层分配策略,用于解决图像到点云配准中的尺度模糊和注意力漂移问题,在RGB-D Scenes V2和7-Scenes数据集上达到最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20390 2026-05-26 cs.RO 57%

NeuralTouch: Neural Descriptors for Precise Sim-to-Real Tactile Robot Control

NeuralTouch: 用于精确的仿真到现实触觉机器人控制的神经描述符

Yijiong Lin, Bowen Deng, Keju Pu, Chenghua Lu, Max Yang, Efi Psomopoulou, Nathan F. Lepora

机构 * Department of Engineering Mathematics and Bristol Robotics Laboratory(工程数学系和布里斯托尔机器人实验室)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 提出NeuralTouch多模态框架,结合神经描述符场(NDF)和触觉感知,通过深度强化学习策略利用触觉反馈优化抓取姿态,实现精确且可泛化的机器人操作。

Journal ref IEEE/ASME Transactions on Mechatronics, 2026 IEEE/ASME Transactions on Mechatronics IEEE/ASME Transactions on Mechatronics

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24777 2026-05-26 cs.RO 57%

MR-LiDAR: A Multi-Resolution Roadside LiDAR Benchmark for Perception Diagnostics and Deployment Guidance

MR-LiDAR:用于感知诊断和部署指导的多分辨率路边激光雷达基准

Shunlai Cui, Peng Cao, Yuan Zhu, Yongjiang He, Jiacheng Yin, Xiao Huo, Gang Cao, Xiaobo Liu

机构 * Intelligent Comprehensive Transportation Key Laboratory of Sichuan Province(四川省智能综合交通运输重点实验室)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 针对激光雷达选型缺乏实证基准的问题,提出MR-LiDAR多分辨率基准,通过控制光束数和分布等变量,系统分析其对感知性能的影响,并给出选型指导。

Comments 9 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2105.01215 2026-05-26 cs.RO 57%

Lidar Scan Registration Robust to Extreme Motions

对极端运动鲁棒的激光雷达扫描配准

Simon-Pierre Deschênes, Dominic Baril, Vladimír Kubelka, Philippe Giguère, François Pomerleau

机构 * Northern Robotics Laboratory(北方机器人实验室)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 针对极端运动下点云畸变导致配准失败的问题,提出一种考虑轨迹运动不确定性和环境几何的去畸变方法,在200 m/s^2和800 rad/s^2的峰值加速度下,平移误差降低9.26%,旋转误差降低21.84%。

Comments 8 pages, 8 figures, published in 2021 18th Conference on Robots and Vision (CRV), Burnaby, Canada

Journal ref 2021 18th Conference on Robots and Vision (CRV), 2021, pp. 17-24

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03134 2026-05-26 eess.SP cs.CV 57%

Controllable Radar Simulation with Waveform Parameter Embedding

具有波形参数嵌入的可控雷达仿真

Weiqing Xiao, Hao Huang, Chonghao Zhong, Yujie Lin, Nan Wang, Xiaoxue Chen, Zhaoxi Chen, Saining Zhang, Shuocheng Yang, Pierre Merriaux, Lei Lei, Hao Zhao

机构 * NJU(南京大学) BJTU(北京理工大学) BIT(北京理工大学) AIR, THU(空气科技,清华大学) NTU(国立台湾大学) SVM, THU(SVM,清华大学) Lightwheel AI LeddarTech

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 提出Ctrl-RS框架,通过环境反射张量、波形参数抽象和WARP-Net网络,实现可控的雷达立方体仿真,在2D/3D检测和语义分割任务中性能接近或超越真实雷达。

Comments CVPR 2026 Findings: Code: https://github.com/zhuxing0/SA-Radar Project page: https://zhuxing0.github.io/projects/SA-Radar

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.02836 2026-05-26 cs.LG math.AT 50%

A Closed-Form Persistence-Landmark Pipeline for Certified Point-Cloud and Graph Classification

一种用于认证点云和图分类的闭式持久性-地标管道

Sushovan Majhi, Atish Mitra, Žiga Virk, Pramita Bagchi

机构 * Data Science, George Washington University, USA(乔治华盛顿大学数据科学系) Department of Mathematical Sciences, Montana Technological University, USA(蒙塔纳技术大学数学科学系) Faculty of Computer and Information Science, University of Ljubljana, Institute IMFM, Slovenia(卢布尔雅那大学计算机与信息科学系,IMFM研究所,斯洛文尼亚) Biostatistics and Bioinformatics, George Washington University, USA(乔治华盛顿大学生物统计学与生物信息学系)

专题命中 点云 :point cloud(abstract)

AI总结 提出PLACE管道,通过闭式公式从持久同调签名中分类点云和图,无需学习权重或校准,提供基于间隔的过量风险率、描述符选择规则和每个预测的认证。

Comments TMLR submission, https://openreview.net/forum?id=4kZxNlE5Ve. v2: variance-aware Pinelis-Bernstein certificate (radius iii) fires on 8/12 benchmarks (v1: not operational); MUTAG: empirical and population NC rules agree on 940/940 predictions. Matching-free nu-coherence replaces non-interference. Le Cam lower bound (Thm 3.2) recast PD-native, matching regime m<~R/D explicit

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25577 2026-05-26 cs.LG cs.AI 50%

Geometric Flow Matching for Molecular Conformation Generation via Manifold Decomposition

基于流形分解的几何流匹配分子构象生成

Yunqing Liu, Yi Zhou, Wenqi Fan

机构 * The Hong Kong Polytechnic University(香港理工大学)

专题命中 点云 :point cloud(abstract)

AI总结 提出GO-Flow方法,通过将生成过程分解为平移、旋转和构象三个物理子空间,利用流形上的最优传输和测地流,解决现有方法忽略分子几何层次结构的问题,实现高质量、高效率的分子构象生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24013 2026-05-26 physics.chem-ph 50%

UniField: RBF-Guided Electron Density Fusion for Enhanced Molecular Representations

UniField: RBF引导的电子密度融合用于增强分子表示

Wei Zhang, Kun Li, Jiameng Chen, Jiajun Yu, Yizhen Zheng, Duanhua Cao, Wenbin Hu

专题命中 点云 :point cloud(abstract)

AI总结 提出UniField,一种SE(3)-等变多模态架构,通过融合离散拓扑图与连续电子密度场,在多个基准上取得最先进性能。

详情

展开后加载摘要…

URL PDF HTML 收藏