arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-06-24 至 2026-06-24 共收录 6 信号源:cs.CV, cs.GR, cs.RO

1. 点云 6 篇

2606.24433 2026-06-24 cs.CV cs.AI cs.LG 新提交 79%

MedPCFM: Improving Medical Point Cloud Completion by Integrating Point Transformers and Flow Matching

MedPCFM: 通过集成点变换器和流匹配改进医学点云补全

Kamil Kwarciak, Marek Wodzinski

机构 * Department of Measurement and Electronics, AGH University of Krakow(AGH科技大学测量与电子系) Sano Centre for Computational Medicine(Sano计算医学中心)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 提出基于PTv3的流匹配方法PCFM用于医学点云补全,在三个数据集上达到最优生成性能,采样步数远少于扩散模型,且PTv3带来高达7倍的速度提升。

Comments 25 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24175 2026-06-24 cs.CV 新提交 79%

Tri-Efficient Transfer Learning for Point Cloud Videos

点云视频的三效迁移学习

Yiding Sun, Dongxu Zhang, Jihua Zhu, Haozhe Cheng, Zhengqiao Li, Pengcheng Li, Chaowei Fang, Yonghao Dong, Lin Chen

机构 * School of Software Engineering, Xi’an Jiaotong University(西安交通大学软件学院) School of Information and Communication Engineering, Xi’an Jiaotong University(西安交通大学信息与通信工程学院) SIGS, Tsinghua University(清华大学深圳国际研究生院)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 提出PoinTriE框架,通过伪运动轨迹合成、几何-运动对偶网络和时空侧网络,实现数据、参数和内存三方面高效的点云视频迁移学习,在动作识别和语义分割任务上取得新最优结果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24301 2026-06-24 cs.CV 新提交 70%

MM-TRELLIS: Point-Cloud Guided Multi-Modal 3D Vehicle Generation in Autonomous Driving

MM-TRELLIS: 自动驾驶中基于点云引导的多模态3D车辆生成

Hongli Xiao, Youjian Zhang, Yucai Bai, Chaoyue Wang, Yaohui Jin, Xiaoguang Ren, Wenjing Yang, Long Lan

机构 * MoE Key Lab of Artificial Intelligence, AI Institute, Shanghai Jiao Tong University(上海交通大学人工智能研究院教育部人工智能重点实验室) Academy of Military Science(军事科学院) Bosch innovation software development (Wuxi) Co., Ltd.(博世创新软件开发(无锡)有限公司) College of Computer Science and Technology, National University of Defense Technology(国防科技大学计算机学院) Shopee Pte. Ltd.(Shopee私人有限公司)

专题命中 点云 :Gaussian Splatting(abstract);point cloud(abstract);分类 cs.CV

AI总结 提出MM-TRELLIS,融合多视图图像与LiDAR点云,通过点云引导和体素过滤策略,实现高质量3D车辆生成,在Waymo数据集上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24464 2026-06-24 cs.CV 新提交 57%

Boosting Text-Driven Video Segmentation via Geometry-Aware Distillation

通过几何感知蒸馏提升文本驱动视频分割

Tianyu Zhu, Yingping Liang, Hesong Li, Ying Fu

机构 * Beijing Institute of Technology(北京理工大学)

专题命中 点云 :spatial understanding(abstract);分类 cs.CV

AI总结 提出GeoLaV两阶段框架,通过单目几何预训练和几何感知蒸馏,将3D几何知识从图像迁移到视频,提升文本驱动视频分割的时空一致性和语言定位能力,在多个基准上达到最优。

Comments Accepted by ECCV2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24178 2026-06-24 cs.CV cs.AI 新提交 57%

Zero-Shot Test-Time Canonicalization using Out-of-Distribution Scoring

零样本测试时规范化使用分布外评分

Dominik Lindner, Johann Schmidt, Tom Siegl, Martin Becker, Sebastian Stober

机构 * Artificial Intelligence Lab, Otto-von-Guericke University Magdeburg(马格德堡大学人工智能实验室) University of Rostock(罗斯托克大学) Becker Lab, University of Marburg(马尔堡大学贝克尔实验室)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 提出将测试时规范化重新定义为分布外检测问题,系统评估约20种OOD评分和9种搜索算法,发现基于距离的评分配合随机搜索与局部细化效果最佳,并引入门控机制保护分布内精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23834 2026-06-24 cs.CE 新提交 50%

Efficient implementation of graph autoencoders for model-order reduction of systems with sharp gradients

用于具有尖锐梯度的系统模型降阶的图自编码器高效实现

Liam K Magargal, Parisa Khodabakhshi

专题命中 点云 :point cloud(abstract)

AI总结 提出图自编码器与算子学习结合的GNN-LaSDI框架,用于高维动力系统的非线性降阶,在尖锐梯度区域比POD方法更准确,计算成本介于GD-LSPG和POD-LaSDI之间。

Comments 31 pages, 16 figures

详情

展开后加载摘要…

URL PDF HTML 收藏