arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

共收录 7719 信号源:cs.CV, cs.GR, cs.RO

1. 点云 7719 篇

2604.06341 2026-04-09 cs.RO 57%

Occlusion Handling by Pushing for Enhanced Fruit Detection

通过推动提升水果检测的遮挡处理

Ege Gursoy, Dana Kulić, Andrea Cherubini

机构 * LIRMM, Univ. Montpellier, CNRS(蒙彼利埃大学-法国国家科学研究中心-蒙彼利埃机器人研究所) Monash University(莫纳什大学)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 本文提出通过推动清除遮挡物提升水果检测效果,结合深度学习、经典图像处理和3D霍夫变换实现遮挡处理。

Journal ref IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS), 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05354 2026-04-08 cs.CV 57%

Unsupervised Multi-agent and Single-agent Perception from Cooperative Views

无监督多智能体和单智能体感知:协作视角

Haochen Yang, Baolu Li, Lei Li, Delin Ren, Jiacheng Guo, Minghai Qin, Tianyun Zhang, Hongkai Yu

机构 * Cleveland State University(克利夫兰州立大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文提出UMS框架,通过多智能体协作提升点云密度,利用协作视角进行无监督3D目标检测,实验证明在V2V4Real和OPV2V数据集上性能优于现有方法。

Comments Accepted to CVPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05212 2026-04-08 cs.CV 57%

Boxer: Robust Lifting of Open-World 2D Bounding Boxes to 3D

Boxer:鲁棒的开放世界2D边界框到3D提升

Daniel DeTone, Tianwei Shen, Fan Zhang, Lingni Ma, Julian Straub, Richard Newcombe, Jakob Engel

机构 * Meta Reality Labs Research(Meta现实实验室)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 Boxer通过Transformer网络将2D边界框提升到3D,结合多视角融合和几何过滤,实现鲁棒的3D边界框估计,减少对标注数据的依赖,提升开放世界下的定位性能。

Comments project page: http://facebookresearch.github.io/boxer

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04658 2026-04-07 cs.CV 57%

Synthesis4AD: Synthetic Anomalies are All You Need for 3D Anomaly Detection

Synthesis4AD:合成异常就是3D异常检测所需

Yihan Sun, Yuqi Cheng, Junjie Zu, Yuxiang Tan, Guoyang Xie, Yucheng Wang, Yunkang Cao, Weiming Shen

机构 * National Center of Technology Innovation for Intelligent Design and Numerical Control, Huazhong University of Science and Technology(华中科技大学国家智能设计与数控技术创新中心) School of Artificial Intelligence and Robotics, Hunan University(湖南大学人工智能与机器人学院) Department of Intelligent Manufacturing, Contemporary Amperex Technology Ltd.(宁德时代新能源科技股份有限公司智能制造部) Institute for Infocomm Research, A*STAR(新加坡科技研究局资讯通信研究院) School of Electrical and Electronic Engineering, Nanyang Technological University(南洋理工大学电气与电子工程学院)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文提出Synthesis4AD方法,通过大规模高保真合成异常数据提升3D异常检测性能,利用3D-DefectStudio平台生成精确点云异常掩码,并结合多模态大语言模型实现知识驱动的数据生成,实验表明在多个数据集上达到领先水平。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04406 2026-04-07 cs.CV 57%

3D-Fixer: Coarse-to-Fine In-place Completion for 3D Scenes from a Single Image

3D-Fixer:从单张图像生成3D场景的粗到细就地补全

Ze-Xin Yin, Liu Liu, Xinjie Wang, Wei Sui, Zhizhong Su, Jian Yang, Jin Xie

机构 * College of Computer Science, Nankai University(南开大学计算机科学学院) School of Intelligence Science and Technology, Nanjing University(南京大学智能科学与技术学院) Horizon Robotics(地平线机器人) D-Robotics

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文提出3D-Fixer,通过粗到细的生成方案解决单张图像生成3D场景的布局和3D资产恢复问题,结合双分支条件网络和Occlusion-Robust Feature Alignment策略,提升生成精度和效率,同时引入ARSG-110K数据集提升训练效果。

Comments 17 pages, 10 figures, CVPR 2026, project page: https://zx-yin.github.io/3dfixer

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04166 2026-04-07 cs.RO 57%

Primitive-based Truncated Diffusion for Efficient Trajectory Generation of Differential Drive Mobile Manipulators

基于原始的截断扩散用于差分驱动移动机械臂高效轨迹生成

Long Xu, Choilam Wong, Yuhang Zhong, Junxiao Lin, Jialiang Hou, Fei Gao

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 本文提出一种学习增强的运动规划器,通过关键点序列提取模块和基于原始的截断扩散模型提升轨迹生成效率与多样性。

Comments 9 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03730 2026-04-07 cs.RO 57%

A Multi-View 3D Telepresence System for XR Robot Teleoperation

面向XR机器人远程操控的多视角3D临场系统

Enes Ulas Dincer, Manuel Zaremski, Alexandra Nick, Elias Wucher, Barbara Deml, Gerhard Neumann

机构 * Institute for Anthropomatics and Robotics, Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院人类学与机器人研究所) Institute of Human and Industrial Engineering, Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院人因与工业工程研究所)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 本文提出一种多视角VR临场系统,通过融合三视角几何数据生成GPU加速点云渲染,并结合腕部RGB流提供高分辨率局部细节,实验证明其在远程操控任务中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03334 2026-04-07 cs.CV 57%

Bridging the Dimensionality Gap: A Taxonomy and Survey of 2D Vision Model Adaptation for 3D Analysis

弥合维度差距:2D视觉模型适应3D分析的分类与综述

Akshat Pandya, Bhavuk Jain

机构 * Independent Researcher(独立研究员)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文综述了将2D视觉模型适应3D分析的策略,分类为数据导向、架构导向和混合方法,探讨了计算复杂度、预训练依赖性和几何归纳偏置的权衡。

Comments VISAPP 2026

Journal ref Proceedings of the 21st International Conference on Computer Vision Theory and Applications - Volume 3: VISAPP 2026; ISBN 978-989-758-804-4; ISSN 2184-4321, SciTePress, pages 353-364

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14507 2026-04-07 cs.CV 57%

Expanding mmWave Datasets for Human Pose Estimation with Unlabeled Data and LiDAR Datasets

通过未标记数据和LiDAR数据扩展毫米波数据集用于人体姿态估计

Zhuoxuan Peng, Boan Zhu, Xingjian Zhang, Wenying Li, S. -H. Gary Chan

机构 * The Hong Kong University of Science and Technology(香港科技大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文提出EMDUL方法,利用未标记毫米波数据和LiDAR数据扩展现有数据集,提升人体姿态估计模型的性能和泛化能力,减少15.1%和18.9%的误差。

Comments Accepted by CVPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03096 2026-04-06 cs.RO 57%

An Open-Source LiDAR and Monocular Off-Road Autonomous Navigation Stack

开源的激光雷达与单目越野自主导航栈

Rémi Marsal, Quentin Picard, Adrien Poiré, Sébastien Kerbourc'h, Thibault Toralba, Clément Yver, Alexandre Chapoutot, David Filliat

机构 * U2IS, ENSTA, Institut Polytechnique de Paris(巴黎综合理工学院,ENSTA,U2IS) AMIAD, Pôle Recherche(AMIAD,研究部) LARIAD, a joint AMIAD-ENSTA laboratory(LARIAD,AMIAD-ENSTA联合实验室)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 本文提出一个开源的越野导航栈,结合激光雷达和单目3D感知,无需特定任务训练,通过边缘遮蔽和时间平滑提升鲁棒性,实验证明单目深度估计可替代激光雷达。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02252 2026-04-03 cs.CV 57%

SPAR: Single-Pass Any-Resolution ViT for Open-vocabulary Segmentation

SPAR:单次通过任意分辨率ViT用于开放词汇分割

Naomi Kombol, Ivan Martinović, Siniša Šegvić, Giorgos Tolias

专题命中 点云 :spatial understanding(abstract);分类 cs.CV

AI总结 SPAR通过单次通过任意分辨率ViT实现高效高分辨率推理,提升开放词汇分割的mIoU性能,无需架构改动或像素级监督。

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01598 2026-04-03 cs.CV 57%

Riemannian and Symplectic Geometry for Hierarchical Text-Driven Place Recognition

Riemannian和Symplectic几何用于层次化文本驱动的位置识别

Tianyi Shang, Zhenyu Li

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文提出SympLoc框架,通过多级对齐策略提升文本到点云定位的鲁棒性,实验显示在KITTI360Pose数据集上Top-1召回率提升19%。

Comments 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01171 2026-04-02 cs.CV 57%

Open-Set Supervised 3D Anomaly Detection: An Industrial Dataset and a Generalisable Framework for Unknown Defects

开集监督三维异常检测:一个工业数据集和一个通用框架用于未知缺陷

Hanzhe Liang, Luocheng Zhang, Junyang Xia, HanLiang Zhou, Bingyang Guo, Yingxi Xie, Can Gao, Ruiyun Yu, Jinbao Wang, Pan Li

机构 * Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) School of Computer Science, Hangzhou Dianzi University(杭州电子科技大学计算机学院) Software College, Northeastern University(东北大学软件学院) Shenzhen Audencia Financial Technology Institute(深圳南特金融科技学院) College of Computer Science and Software Engineering, Shenzhen University(深圳大学计算机与软件学院) School of Artificial Intelligence, Shenzhen University(深圳大学人工智能学院) Zhejiang Institute of Artificial Intelligence(浙江省人工智能研究所) Northeastern University(东北大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文提出Open3D-AD框架,利用正常样本、模拟异常和部分观察的真实异常,通过对应分布采样减少正常与非正常分布重叠,提升开集监督三维异常检测性能。

Comments Resources: https://github.com/hzzzzzhappy/open-industry

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01129 2026-04-02 cs.CV 57%

ReinDriveGen: Reinforcement Post-Training for Out-of-Distribution Driving Scene Generation

ReinDriveGen:强化学习后训练用于分布外驾驶场景生成

Hao Zhang, Lue Fan, Weikang Bian, Zehuan Wu, Lewei Lu, Zhaoxiang Zhang, Hongsheng Li

机构 * MMLab, CUHK(MMLab,香港中文大学) CASIA(中国科学院自动化研究所) SenseTime Research(商汤科技研究院)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 ReinDriveGen通过动态点云场景生成与强化学习后训练,实现对驾驶场景的可控生成,提升安全关键场景的模拟质量。

Comments Project page: https://drive-sim.github.io/ReinDriveGen/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02413 2026-04-02 cs.CV cs.AI 57%

Enhancing Floor Plan Recognition: A Hybrid Mix-Transformer and U-Net Approach for Precise Wall Segmentation

增强平面识别:一种混合Mix-Transformer和U-Net方法用于精确墙体分割

Dmitriy Parashchuk, Alexey Kaspshitskiy, Yuriy Karyakin

机构 * Tyumen State University(秋明国立大学)

专题命中 点云 :3D reconstruction(abstract);分类 cs.CV

AI总结 本文提出MitUNet,结合Mix-Transformer和U-Net,通过改进的损失函数提升墙体分割精度,实验显示其在CubiCasa5k数据集上表现优异,为自动化3D重建提供基础。

Comments 11 pages, 5 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22337 2026-04-02 cs.CV 57%

Learning to Infer Parameterized Representations of Plants from 3D Scans

从3D扫描中学习植物参数化表示

Samara Ghrer, Christophe Godin, Stefanie Wuhrer

机构 * Inria center at Université Grenoble Alpes(法国国家信息与自动化研究所格勒诺布尔阿尔卑斯大学中心) Inria center at Lyon(法国国家信息与自动化研究所里昂中心)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文提出通过递归神经网络从3D点云推断植物参数化结构,用于植物表型分析中的重建、分割和骨架化任务,方法在合成数据上训练后能有效泛化到真实3D扫描。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.12194 2026-04-01 cs.RO 57%

UniLGL: Learning Uniform Place Recognition for FOV-limited/Panoramic LiDAR Global Localization

UniLGL:学习适用于视场受限/全景激光雷达全局定位的统一地方识别

Hongming Shen, Xun Chen, Yulin Hui, Zhenyu Wu, Wei Wang, Qiyang Lyu, Tianchen Deng, Danwei Wang

机构 * School of Automation, Hangzhou Dianzi University(杭州电子科技大学自动化学院)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 UniLGL通过编码完整点云生成空间和材质均匀性,结合多BEV融合网络实现统一特征提取,引入视角不变假设提升异构激光雷达的鲁棒性,最终在真实环境中验证了其在高精度定位与多无人机协同探索中的有效性。

Journal ref IEEE TRANSACTIONS ON ROBOTICS, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06874 2026-04-01 cs.CV 57%

MVGGT: Multimodal Visual Geometry Grounded Transformer for Multiview 3D Referring Expression Segmentation

MVGGT:多模态视觉几何 grounded 变换器用于多视角3D指称表达分割

Changli Wu, Haodong Wang, Jiayi Ji, Yutian Yao, Chunsai Du, Jihua Kang, Yanwei Fu, Liujuan Cao

机构 * Key Laboratory of Multimedia Trusted Perception and Efficient Computing, Ministry of Education of China, Xiamen University(厦门大学多媒体可信感知与高效计算教育部重点实验室) Shanghai Innovation Institute(上海创新研究院) Fudan University(复旦大学) ByteDance(字节跳动) Tianjin University of Science and Technology(天津科技大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文提出MVGGT,一种高效的端到端框架,通过双分支设计将语言信息整合到稀疏视角的几何推理中,解决稀疏视角下的优化障碍,建立首个强基线,实现高精度和快速推理。

Comments Accepted to CVPR 2026; Project Website: https://mvggt.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06285 2026-04-01 cs.RO 57%

DCReg: Decoupled Characterization for Efficient Degenerate LiDAR Registration

DCReg: 用于高效退化LiDAR配准的解耦表征

Xiangcheng Hu, Xieyuanli Chen, Mingkai Jia, Jin Wu, Ping Tan, Steven L. Waslander

机构 * Hong Kong University of Science and Technology(香港科技大学) National University of Defense Technology(国防科技大学) University of Science and Technology Beijing(北京科技大学) University of Toronto(多伦多大学)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 本文提出DCReg方法,通过解耦配准问题中的退化因素,提高配准稳定性与精度,实验显示在多种环境中实现更高的定位精度和更快的计算速度。

Comments 27 pages, 19 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28224 2026-03-31 cs.CV 57%

Ghost-FWL: A Large-Scale Full-Waveform LiDAR Dataset for Ghost Detection and Removal

Ghost-FWL: 一种大规模全波形激光雷达数据集用于鬼影检测与去除

Kazuma Ikeda, Ryosei Hara, Rokuto Nagata, Ozora Sako. Zihao Ding, Takahiro Kado, Ibuki Fujioka, Taro Beppu, Mariko Isogawa, Kentaro Yoshioka

机构 * Keio University(庆应义塾大学) Sony Semiconductor Solutions(索尼半导体解决方案)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文提出Ghost-FWL数据集,用于解决移动激光雷达中鬼影点的检测与去除问题,通过全波形激光雷达数据提升3D映射和定位精度,实验表明其在SLAM和目标检测任务中效果显著。

Comments Accepted to CVPR 2026 (Main)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27969 2026-03-31 cs.CV 57%

Hg-I2P: Bridging Modalities for Generalizable Image-to-Point-Cloud Registration via Heterogeneous Graphs

Hg-I2P:通过异构图实现通用的图像到点云配准

Pei An, Junfeng Ding, Jiaqi Yang, Yulong Wang, Jie Ma, Liangliang Nan

机构 * Huazhong University of Science and Technology(华中科技大学) Northwestern Polytechnical University(西北工业大学) Huazhong Agricultural University(华中农业大学) Delft University of Technology(代尔夫特理工大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文提出Hg-I2P方法,通过异构图融合多模态特征,提升图像与点云配准的泛化能力和精度。

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13689 2026-03-31 cs.CV 57%

LitePT: Lighter Yet Stronger Point Transformer

LitePT: 更轻更强大的点云变换器

Yuanwen Yue, Damien Robert, Jianyuan Wang, Sunghwan Hong, Jan Dirk Wegner, Christian Rupprecht, Konrad Schindler

机构 * ETH Zurich(苏黎世联邦理工学院) University of Oxford(牛津大学) University of Zurich(苏黎世大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文提出LitePT模型,通过在早期阶段使用卷积层,后期切换至注意力机制,减少参数并提升效率,同时在多个任务和数据集上表现优异。

Comments CVPR 2026, Project page: https://litept.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.23227 2026-03-31 cs.CV 57%

PointCNN++: Performant Convolution on Native Points

PointCNN++: 针对原始点的高效卷积

Lihan Li, Haofeng Zhong, Rui Bu, Mingchao Sun, Wenzheng Chen, Baoquan Chen, Yangyan Li

机构 * Peking University(北京大学) Ant Group(蚂蚁集团) AMAP(高德地图)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 PointCNN++提出了一种新的架构设计,通过将稀疏卷积从体素扩展到点,解决了精度与性能之间的权衡问题,实现了高保真和高效3D学习。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27663 2026-03-31 cs.CV 57%

LiDAR for Crowd Management: Applications, Benefits, and Future Directions

激光雷达用于人群管理:应用、优势与未来方向

Abdullah Khanfor, Chaima Zaghouani, Hakim Ghazzai, Ahmad Alsharoa, Gianluca Setti

机构 * College of Computer Science and Information Systems, Najran University(纳吉兰大学计算机科学与信息系统学院) College of Innovation & Technology, University of Michigan-Flint(密歇根大学弗林特分校创新与技术学院) King Abdullah University of Science and Technology (KAUST)(阿卜杜拉国王科技大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文探讨了激光雷达在人群管理中的应用与优势,分析了其在隐私保护、恶劣天气适应性和三维建模方面的优势,并提出未来研究方向,包括数据集稀缺性、传感器融合与点云处理等。

Comments 8 pages, 5 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27573 2026-03-31 cs.GR 57%

SPREAD: Spatial-Physical REasoning via geometry Aware Diffusion

SPREAD:通过几何感知扩散进行空间-物理推理

Minzhang Li, Kuixiang Shao, Xuebing Li, Yuyang Jiao, Yinuo Bai, Hengan Zhou, Sixian Shen, Jiayuan Gu, Jingyi Yu

专题命中 点云 :point cloud(abstract);分类 cs.GR

AI总结 SPREAD通过图Transformer联合学习空间和物理关系,利用场景点云进行几何感知,整合可微指导实现碰撞避免和物理一致性,实验显示在空间关系和物理指标上达到SOTA。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23153 2026-03-31 cs.CV cs.AI 57%

Efficient Encoder-Free Fourier-based 3D Large Multimodal Model

高效无编码器的基于傅里叶的3D大多模态模型

Guofeng Mei, Wei Lin, Luigi Riz, Yujiao Wu, Yiming Wang, Fabio Poiesi

机构 * Fondazione Bruno Kessler, Italy(意大利布鲁诺·凯斯勒基金会) JKU Linz, Austria(奥地利林茨约翰·开普勒大学) CSIRO, Australia(澳大利亚联邦科学与工业研究组织)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文提出Fase3D,一种基于傅里叶变换的无编码器3D多模态模型,通过结构化超点和空间填充曲线实现高效全局上下文建模,显著提升计算效率和参数效率。

Journal ref CVPR 2026 camera ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26412 2026-03-30 cs.RO 57%

Generalizable task-oriented object grasping through LLM-guided ontology and similarity-based planning

通过LLM引导的本体和基于相似性的规划实现通用任务导向物体抓取

Hao Chen, Takuya Kiyokawa, Weiwei Wan, Kensuke Harada

机构 * Graduate School of Engineering Science, The University of Osaka(大阪大学工学研究科)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 本文提出基于LLM的本体和相似性规划方法,解决任务导向抓取中部分识别和抓取区域选择的稳定性问题,提升抓取的通用性和鲁棒性。

Comments Accepted by Robotics and Autonomous Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26262 2026-03-30 cs.CV cs.LG 57%

GLASS: Geometry-aware Local Alignment and Structure Synchronization Network for 2D-3D Registration

GLASS:面向2D-3D配准的几何感知局部对齐与结构同步网络

Zhixin Cheng, Jiacheng Deng, Xinjun Li, Bohao Liao, Li Liu, Xiaotian Yin, Baoqun Yin, Tianzhu Zhang

机构 * School of Information Science and Technology, University of Science and Technology of China(中国科学技术大学信息科学技术学院) Institute of Advanced Technology, University of Science and Technology of China(中国科学技术大学先进技术研究院) Meituan Inc(美团)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文提出GLASS网络,通过局部几何增强和图分布一致性模块,解决重复模式下2D-3D配准中的结构不一致问题,提升匹配精度。

Comments Accepted by IEEE Transactions on Circuits and Systems for Video Technology

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25993 2026-03-30 cs.CV 57%

FAST3DIS: Feed-forward Anchored Scene Transformer for 3D Instance Segmentation

FAST3DIS:用于3D实例分割的前馈锚定场景Transformer

Changyang Li, Xueqing Huang, Shin-Fang Chng, Huangying Zhan, Qingan Yan, Yi Xu

机构 * Goertek Alpha Labs(歌尔阿尔法实验室)

专题命中 点云 :3D reconstruction(abstract);分类 cs.CV

AI总结 本文提出FAST3DIS,一种端到端的3D实例分割方法,通过前馈锚定场景Transformer避免后处理聚类,提升分割精度与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20721 2026-03-27 cs.CV cs.AI cs.LG cs.NE 57%

Foundry: Distilling 3D Foundation Models for the Edge

Foundry:为边缘设备蒸馏3D基础模型

Guillaume Letellier, Siddharth Srivastava, Frédéric Jurie, Gaurav Sharma

机构 * GREYC, Normandy University, Unicaen, ENSICAEN, UMR CNRS 6072(GREYC,诺曼底大学,卡昂大学,ENSICAEN,CNRS UMR 6072) IIT Delhi(印度理工学院德里分校) IIT Kanpur(印度理工学院坎普尔分校)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文提出Foundry,一种蒸馏3D点云的大规模自监督学习模型的方法,通过压缩模型保留通用表示能力,使模型更适用于资源受限的边缘设备。

Comments Accepted at CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏