arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-07-15 至 2026-07-15 共收录 14 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 3 篇

2607.05801 2026-07-15 cs.CV cs.RO 版本更新 62%

TRIG: Trajectory-Rig Decoupled Metric Geometry Learning

TRIG:轨迹-装置解耦度量几何学习

Lizhou Liao, Wentao Xu, Handong Wang, Lirong Yang, Shuai Yang, Weiwei Liu, Chang Huang

机构 * Carizon(卡里松) ShanghaiTech University(上海科技大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV、cs.RO

AI总结 针对自动驾驶中视觉几何模型不适用于刚性多相机驱动系统的问题,提出TRIG框架,将相机姿态分解,引入解耦编码与监督及稀疏时空注意力,在多基准测试中实现姿态估计、深度预测和3D重建的最优性能。

Comments 10 pages, 4 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12939 2026-07-15 cs.CV 新提交 57%

Point Tracking in Surgery--The 2025 Surgical Tattoos in Infrared Challenge (STIRC2025)

手术中的点跟踪——2025年红外手术纹身挑战(STIRC2025)

Adam Schmidt, Mert Asim Karaoglu, Zijian Wu, Jiaming Zhang, Yuxin Chen, Tim Salcudean, Ho-Gun Ha, Minkang Jang, Kyungmin Jung, Ihsan Ullah, Hyunki Lee, Suresh Guttikonda, Sarah Latus, Alexander Schlaefer, Xinkai Zhao, Yuichiro Hayashi, Masahiro Oda, Takayuki Kitasaka, Kensaku Mori, Peng Liu, Chenyang Li, Stefanie Speidel, Aoife Gardiner, Agostino Stilli, Danail Stoyanov, Francisco Vasconcelos, Anwesa Choudhuri, Meng Zheng, Zhongpai Gao, Benjamin Planche, Van Nguyen Nguyen, Terrence Chen, Ziyan Wu, Alexander Ladikos, Omid Mohareri

机构 * Intuitive Surgical Inc.(直观外科公司) ImFusion GmbH(ImFusion有限公司) Technical University of Munich(慕尼黑工业大学) University of British Columbia(英属哥伦比亚大学) Johns Hopkins University(约翰·霍普金斯大学) Daegu Gyeongbuk Institute of Science and Technology(大邱庆北科学技术院) Hamburg University of Technology(汉堡工业大学) SustAInLivWork Center of Excellence(可持续生活工作卓越中心) Graduate School of Informatics, Nagoya University(名古屋大学信息科学研究生院) Information Technology Center, Nagoya University(名古屋大学信息技术中心) Department of Information Science, Aichi Institute of Technology(爱知工业大学信息科学系) Research Center for Medical Bigdata, National Institute of Informatics(国立信息学研究所医学大数据研究中心) Department of Translational Surgical Oncology, National Center for Tumor Diseases (NCT), NCT/UCC Dresden, a partnership between DKFZ, Faculty of Medicine and University Hospital Carl Gustav Carus, TUD Dresde(德累斯顿国家肿瘤疾病中心(NCT)转化外科肿瘤学系,NCT/UCC德累斯顿,由德国癌症研究中心、医学院和卡尔·古斯塔夫·卡鲁斯大学医院、德累斯顿工业大学合作成立)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 介绍2025年手术点跟踪挑战(STIRC2025),参与者提交算法基于红外手术纹身数据集(STIR)评估,含准确性和效率两组件,作为MICCAI EndoVis 2025一部分进行,总结结果与方法,数据集和代码可获取。

Comments 9 pages, 12 figures. arXiv admin note: substantial text overlap with arXiv:2503.24306

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12379 2026-07-15 cs.CV 新提交 57%

SeamGen: Artist-Aligned UV Seam Generation via Graph Flow Matching

SeamGen:通过图流匹配生成与艺术家对齐的UV接缝

Hao Xu, Yuqing Zhang, Yiqian Wu, Xueqi Ma, Ding Liang, Yan-Pei Cao, Ying-Tian Liu, Xiaogang Jin

机构 * State Key Lab of CAD&CG, Zhejiang University(浙江大学计算机辅助设计与图形学国家重点实验室) VAST(未提及,可能是一个缩写,无法准确翻译)

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

AI总结 研究针对3D内容创作中UV接缝放置问题,提出SeamGen模型,通过流匹配从现有接缝布局学习,设计Mesh Transformer主干,利用流模型修复能力,能生成更符合艺术家偏好的UV布局,提升感知质量。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. Gaussian Splatting 6 篇

2607.12641 2026-07-15 cs.MM eess.IV 新提交 88%

GeoFovea-GS: Geometry-Aware Cross-Layer Gaussian Splatting for Wireless Aerial VR

GeoFovea-GS:用于无线空中VR的几何感知跨层高斯点渲染

Zeyi Ren, Wencheng Yan, Jiawen Zhang, Jintao Yan, Sheng Zhou, Zhisheng Niu

专题命中 Gaussian Splatting :3DGS(summary_cn,abstract);Gaussian Splatting(title,abstract)

AI总结 针对无线空中VR中高分辨率视图生成和传输受限,3DGS有几何误差问题,本文提出GeoFovea-GS框架,开发失真度量,将渲染与传输联合选择设为跨层优化问题并设计调度器,实验证明其能降成本提渲染质量。

Comments 7 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12656 2026-07-15 eess.SP 新提交 85%

SpeedyGS: Content-Aware 3D Gaussian Splatting Compression via Two-Stage Optimization

SpeedyGS:通过两阶段优化实现内容感知的3D高斯图元压缩

Junteng Zhang, Tong Chen, Yuxin Zhao, Yibo Shi, Jing Wang, Zhan Ma

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract,abstract_cn)

AI总结 研究针对3D高斯图元压缩解码慢不适用于交互式应用的问题,提出SpeedyGS,通过两阶段优化,即结构形成阶段联合优化自适应量化和剪枝,统计编码阶段转换并编码高斯几何和属性,在多方面取得良好平衡,压缩性能优且解码快。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11673 2026-07-15 cs.CV 版本更新 81%

ABot-3DWorld 0: A Universal World Model to Explore Any 3D Space

ABot-3DWorld 0:一个用于探索任意 3D 空间的通用世界模型

Mingchao Sun, Luyang Tang, Yu Liu, Xu Yan, Zhan Li, Yunwei Zhang, Fei Yu, Zengye Ge, Yumin Liu, Jiacheng Zhang, Yongchang Zhang, Jiawei Zhang, Zhicheng Liu, Zhongxu Sun, Tianjian Ouyang, Wenzheng Chen, Shixing Yang, Nianfei Fan, Guodong Sun, Huan Li, Zheng Zhou, Yongze Li, Yingliang Peng, Mengmeng Du, Yuan Liu, Haozhe Shi, Chunnuo Gong, Chengzhen Yu, Chunxue Jia, Yang Liu, Shiying Zeng, Junnan Lai, Hang Zhang, Ning Guo, Baoquan Chen, Mu Xu, Hongyu Pan

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);point cloud(abstract);分类 cs.CV

AI总结 介绍 ABot-3DWorld 0 通用多模态 3D 世界模型,核心是 SGP,通过特定流程将多模态输入转换为 3D 世界,用于通用 3D 内容创建,在开源方法中领先,多模态输入下场景保真度更高。

Comments Official Page: https://abot-world.amap.com/plaza

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08503 2026-07-15 cs.CV cs.GR cs.RO eess.IV 版本更新 80%

Spherical-GOF: Geometry-Aware Panoramic Gaussian Opacity Fields for 3D Scene Reconstruction

球面-GOF:面向3D场景重建的几何感知全景高斯不透明场

Zhe Yang, Guoqiang Zhao, Sheng Wu, Kai Luo, Kailun Yang

机构 * School of Artificial Intelligence and Robotics, Hunan University(人工智能与机器人学院,湖南大学) National Engineering Research Center of Robot Visual Perception and Control Technology, Hunan University(机器人视觉感知与控制技术国家工程研究中心,湖南大学)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV、cs.GR、cs.RO

AI总结 Spherical-GOF通过球面高斯不透明场实现全景图像的高效渲染,提升3D场景重建的几何一致性和光度质量。

Comments Accepted to IEEE/RSJ IROS 2026. The source code and dataset will be released at https://github.com/1170632760/Spherical-GOF

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12362 2026-07-15 cs.CV 新提交 79%

Implicit 4D Gaussian Splatting for Fast Motion with Large Inter-Frame Displacements

用于大帧间位移快速运动的隐式4D高斯点云渲染

Seung-gyeom Kim, Areum Kim, Yongjae Yoo, Sukmin Yun

机构 * Hanyang University(汉阳大学) Hanyang University ERICA(汉阳大学衣理校区)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);分类 cs.CV

AI总结 针对快速运动大帧间位移下4DGS方法失效问题,提出SPIN-4DGS,从显式时空位置学习高斯属性,用轻量级网络预测属性,避免高内存开销,实验证明该方法在大位移下保真度更高,提升了PSNR和SSIM。

Comments Accepted at ICLR 2026. Project page at https://seung-gyeom.github.io/SPIN-4DGS

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09925 2026-07-15 cs.CV 版本更新 57%

GAINS: Gaussian-based Inverse Rendering from Sparse Multi-View Captures

GAINS:基于高斯的稀疏多视图捕获逆渲染

Patrick Noras, Jun Myeong Choi, Didier Stricker, Pieter Peers, Roni Sengupta

机构 * University Kaiserslautern-Landau(凯撒斯劳滕-兰道大学) German Research Center for Artificial Intelligence(德国人工智能研究中心) University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) College of William & Mary(威廉与玛丽学院)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV

AI总结 研究针对稀疏视图设置下基于高斯的逆渲染精度下降问题,提出GAINS两阶段逆渲染框架,利用基础模型先验稳定几何和材质估计,经实验验证其在提升材质参数精度等方面效果显著,尤其在稀疏视图下优势明显。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 点云 3 篇

2607.12335 2026-07-15 cs.CV 新提交 79%

ProtoPointNet: Prototype-Based Interpretable Classification of 3D Dental Point Clouds with Verifiable Spatial Activations

ProtoPointNet:基于原型的具有可验证空间激活的3D牙齿点云可解释分类

George V. Jose, Thao Liang Chiam, Toby Hughes, Dilan Patel, Alan Brook, Lyle J. Palmer, Nikhil Cherian Kurian

机构 * Adelaide Dental School, Adelaide University(阿德莱德牙科学院,阿德莱德大学) Australian Institute for Machine Learning, Adelaide University(澳大利亚机器学习研究所,阿德莱德大学) School of Public Health, Adelaide University(阿德莱德大学公共卫生学院)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 研究针对3D牙齿点云分类,提出ProtoPointNet模型,结合局部表面几何等特征编码点,通过共享主干学习特定轴原型头,用辅助监督等训练,在Bits2Bites上取得较好结果,其激活定位合理,为牙齿表面对分析提供新的可解释方法。

Comments 2 Figures, 2 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12110 2026-07-15 cs.CV 新提交 79%

ACZ-GSeg: Adaptive Concentric Zone-based Two-stage Ground Segmentation for LiDAR Point Clouds

ACZ-GSeg:基于自适应同心区域的激光雷达点云两阶段地面分割

Ge Zhang Chunyang Wang Bin Liu

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 针对复杂道路场景中地面分割难题,提出基于自适应同心区域模型的两阶段地面分割方法,构建模型确定扇区数量,粗、细分割阶段分别采用不同约束提取和细化地面点,实验证明该方法能适应点云分布特征,提高分割稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12959 2026-07-15 cs.CV 新提交 57%

ViCo3D: Empowering LiDAR-based Collaborative 3D Object Detection with Vision Foundation Models

ViCo3D:利用视觉基础模型增强基于激光雷达的协作式3D目标检测

Haojie Ren, Songrui Luo, Lingfeng Wang, Yan Xia, Yao Li, Jing Li, Lu Zhang, Jiajun Deng, Yanyong Zhang

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 研究针对V2X系统中基于激光雷达协作式3D感知的不足,提出ViCo3D框架。通过将点云投影为图像让VFM提取特征,引入融合模块及跨智能体融合策略,实现了先进的3D检测性能,提升了协作增益。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 3D生成 1 篇

2511.11470 2026-07-15 cs.CV 版本更新 57%

Sat2RealCity: Geometry-Aware and Appearance-Controllable 3D Urban Generation from Satellite Imagery

Sat2RealCity:基于卫星图像的几何感知与外观可控的3D城市生成

Xinliang Wang, Yijie Kang, Zhenyu Wu, Yifeng Shi

机构 * KE Holdings Inc.(KE控股公司) Beijing, China(中国北京)

专题命中 3D生成 :3D generation(abstract);分类 cs.CV

AI总结 针对卫星图像3D城市生成问题,Sat2RealCity框架利用对象级3D生成先验,通过分解城市为地理定位建筑实体,结合构建的数据集,引入空间定位策略、设计外观引导机制及构建语义管道,实现良好的地理对齐、风格一致和资产合成。

Comments The first two authors contributed equally. The fourth author is the corresponding author

详情

展开后加载摘要…

URL PDF HTML 收藏

5. SLAM与定位 1 篇

2511.16144 2026-07-15 cs.CV cs.RO 版本更新 85%

LEGO-SLAM: Language-Embedded Gaussian Optimization SLAM

LEGO-SLAM:语言嵌入的高斯优化SLAM

Sibaek Lee, Seongbo Ha, Kyeongsu Kang, Joonyeol Choi, Seungjun Tak, Hyeonwoo Yu

机构 * Department of Intelligent Robotics, Sungkyunkwan University(智能机器人系,成均馆大学)

专题命中 SLAM与定位 :3DGS(summary_cn,abstract);Gaussian Splatting(abstract);分类 cs.CV、cs.RO

AI总结 研究将语言特征集成到基于3DGS的SLAM系统的问题,提出LEGO-SLAM框架,利用场景自适应自动编码器压缩语言嵌入,实现语言引导剪枝和回环检测,提升映射质量和跟踪精度,具备开放词汇能力且达15FPS。

Comments Project page :https://lab-of-ai-and-robotics.github.io/LEGO-SLAM/ Submitted to IEEE RA-L

详情

展开后加载摘要…

URL PDF HTML 收藏