arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-07-14 至 2026-07-14 共收录 22 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 3 篇

2607.11627 2026-07-14 cs.GR cs.RO 新提交 62%

IBPA: Real-time Free-form Manifold Mesh Reconstruction via Incremental Ball Pivoting with Integrated Hole Detection

IBPA:通过集成孔检测的增量球旋转实现实时自由形式流形网格重建

Mauhing Yip, Mohit Singh, Kostas Alexis, Christian Schellewald, Annette Stahl

机构 * Department of Engineering Cybernetics, NTNU(工程 cybernetics 系,NTNU)

专题命中 三维重建 :point cloud(abstract);分类 cs.GR、cs.RO

AI总结 针对水下航行器获取数据覆盖不完整及传统方法表达能力有限问题,提出IBPA方法,通过改进球旋转算法,从流点云数据增量构建可定向流形网格,引入孔检测机制,支持复杂表面拓扑且无需先验假设。

Comments The source code will be made public after the pre-print paper is available online

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11118 2026-07-14 cs.CV 新提交 57%

GHOST: Geometry-Guided Hallucination of Opaque Surface Textures

GHOST:不透明表面纹理的几何引导幻觉

Langxu Zhao, Zuan Gu, Tianhan Gao

机构 * School of Software, Northeastern University, Shenyang, China(软件学院,东北大学,沈阳,中国)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 针对透明物体给深度估计和3D重建带来的挑战,提出几何引导预处理框架GHOST,利用视觉基础模型,经多步骤处理分离属性、恢复法线先验并整合多模态线索,合成不透明RGB图像,显著提升相关模型对透明物体的处理精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10840 2026-07-14 cs.CV 新提交 57%

OmniX: Any-view and Any-time 4D Reconstruction via Feed-forward Trajectory Fields

OmniX:通过前馈轨迹场进行任意视角和任意时刻的4D重建

Yanqin Jiang, Tengfei Wang, Zhengwei Wang, Chenjie Cao, Junta Wu, Wenhan Luo, Weiming Hu, Jin Gao, Chunchao Guo

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) University of Chinese Academy of Sciences(中国科学院大学) Tencent Hunyuan(腾讯混元) HKUST(香港科技大学) Beijing Key Laboratory of Super Intelligent Security of Multi-Modal Information(多模态信息超智能安全北京重点实验室) School of Information Science and Technology, ShanghaiTech University(上海科技大学信息科学与技术学院)

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

AI总结 针对前馈4D重建方法局限,提出OmniX框架,通过解耦动态运动建模与静态几何预测,利用动态令牌和3D运动结构生成轨迹场,并构建数据引擎和数据集,在多任务上取得领先性能。

Comments Accepted by ECCV 2026, project page: https://omnix4d.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏

2. Gaussian Splatting 8 篇

2607.11184 2026-07-14 cs.RO 新提交 89%

GeoGS-SLAM: Online Monocular Reconstruction Using Gaussian Splatting with Geometric Priors

GeoGS-SLAM:使用带几何先验的高斯点云的在线单目重建

Ruilan Gao, Letian Jin, Yu Zhang

机构 * State Key Laboratory of Industrial Control Technology, College of Control Science and Engineering, Zhejiang University(工业控制技术国家重点实验室,浙江大学控制科学与工程学院) Key Laboratory of Collaborative Sensing and Autonomous Unmanned Systems of Zhejiang Province(浙江省协同感知与自主无人系统重点实验室)

专题命中 Gaussian Splatting :3DGS(summary_cn,abstract);Gaussian Splatting(title,abstract);分类 cs.RO

AI总结 研究提出GeoGS-SLAM在线单目密集重建系统,结合3DGS地图表示与几何先验。利用前馈模型预测先验,通过采样扩展地图,粗到细优化姿态和地图,纳入回环检测与姿态图优化,实验表明其在质量、精度和实时性上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10995 2026-07-14 cs.CV 新提交 83%

AsySplat: Efficient Asymmetric 3D Gaussian Splatting for Long-Sequence Scene Modeling

AsySplat:用于长序列场景建模的高效非对称3D高斯点云渲染

Yingji Zhong, Dave Zhenyu Chen, Fuzhao Ou, Youyu Chen, Zhihao Li, Lanqing Hong, Dan Xu

机构 * HKUST(香港科技大学) Huawei Noah’s Ark Lab(华为诺亚方舟实验室) CityU(城市大学)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);novel view synthesis(abstract);分类 cs.CV

AI总结 研究针对长序列场景建模中3D高斯点云渲染的冗余计算问题,提出非对称架构解耦几何与外观建模,通过双边连接交互,减少计算冗余,提高参数效率,在32视图960P输入上大幅提升效率并超越零样本性能。

Comments The project page is at https://zhongyingji.github.io/asysplat/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10050 2026-07-14 cs.HC 新提交 82%

SyncSpace: Layout-Conditioned 3D Gaussian Splatting for Space Reskinning in Mixed Reality

SyncSpace:用于混合现实中空间重塑的布局条件3D高斯溅射

Qinchuan Zhang, Weibo Xu, Yunge Wen

专题命中 Gaussian Splatting :Gaussian Splatting(title);3DGS(abstract,abstract_cn)

AI总结 SyncSpace系统通过深度感应提取3D边界框,经生成世界模型生成高斯溅射场景,再用粗到精算法与物理空间对齐,实现空间重塑,可展示手部跟踪吞噬交互及同一空间重塑为多风格世界。

Comments 2 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10912 2026-07-14 cs.CV 新提交 79%

DP-Splat: Bayesian Nonparametric Complexity Control for Gaussian Splatting

DP-Splat:用于高斯点云的贝叶斯非参数复杂度控制

Aqi Dong

机构 * Embry-Riddle Aeronautical University(安柏瑞德航空大学)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);分类 cs.CV

AI总结 研究如何控制高斯点云的复杂度,提出用截断的折断棒狄利克雷过程先验等方法,使组件数量适应数据,更新为闭式步骤。实验表明有效复杂度能适应场景,DP先验贡献在复杂度选择,在多方面表现优于固定K的VBGS。

Comments 18 pages, 8 figures. Code and experiment records: https://github.com/archiedong/dp-splat

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10792 2026-07-14 cs.CV 新提交 77%

MAC-Splat: Multi-Attribute Consistency for High-Fidelity Sparse-View Reconstruction

MAC-Splat:用于高保真稀疏视图重建的多属性一致性

Jinqian Yang, Yichen Wu, Wanhua Li, Haokun Lin, Renzhen Wang, Xiangchu Feng, Xixi Jia

机构 * Xidian University(西安电子科技大学) Harvard University(哈佛大学) Nanyang Technological University(南洋理工大学) City University of Hong Kong(香港城市大学) Xi’an Jiaotong University(西安交通大学)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 针对稀疏视图重建中现有方法存在几何伪影的问题,提出MAC-Splat训练框架,利用MASt3R和DINOv3获取2D对应关系并定义MAC损失,联合正则化3D属性,实验证明该方法能有效解决不适定的稀疏视图重建问题,性能优于基线。

Comments Accepted to the European Conference on Computer Vision (ECCV 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10489 2026-07-14 cs.CV 新提交 70%

Grassmannian Splatting I: Moving rank-2 Spacetime Surfels for Dynamic Scene Rendering

格拉斯曼体点云绘制 I:用于动态场景渲染的移动秩-2时空表面元素

Aaron Maurice Berman, Shantanu Dave

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);3DGS(abstract);分类 cs.CV

AI总结 该研究提出格拉斯曼体点云绘制用于动态场景渲染,其基元为特定高斯分布,运动模型封闭,无需学习变形场和自定义CUDA。在17个HyperNeRF场景训练速度最快,PSNR、MS-SSIM和LPIPS排名第二。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10690 2026-07-14 cs.CV 新提交 57%

Incremental Online Scene Reconstruction by 3D Gaussian Triangulation

基于3D高斯三角剖分的增量式在线场景重建

Yanjin Zhu, Shaofan Liu, Jianke Zhu

机构 * Zhejiang University(浙江大学) Hefei University of Technology(合肥工业大学) Shenzhen Loop Area Institute(深圳河套学院)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV

AI总结 研究增量式在线场景重建问题,提出通过直接对密集几何高斯表示三角剖分来重建和更新显式网格的方法,还给出直接网格化算法及相关约束,实验证明该方法性能优于传统高斯方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10237 2026-07-14 cs.CV 新提交 57%

CoSAG: Compact Semantic Anchor Gaussians via Training-Free Rate-Distortion Coding

CoSAG:通过无训练率失真编码实现的紧凑语义锚定高斯模型

Yuang Jia, Jinlong Wang, Junhong Lin, Ruiting Dai, Wei Gao

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV

AI总结 研究开放词汇3D场景理解中存储瓶颈问题,提出CoSAG方法,通过特定构建方式和存储编码,无需场景训练,实现亚兆字节存储,在多项协议上匹配或超越现有技术,大幅减小场大小。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 点云 7 篇

2607.10553 2026-07-14 cs.RO 新提交 57%

SLIDER: Sparse History-Guided Aerial Robot Target Search using Sliding Local Maps

SLIDER:使用滑动局部地图的稀疏历史引导空中机器人目标搜索

Xiaolei Hou, Zheng Pan, Hua Lan, Zhenghao Zou, Yinhong Chen, Chenxi Zhu, Yang Lyu, Jinwen Hu, Chunhui Zhao

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 针对空中机器人在大规模未知环境中目标搜索难题,提出SLIDER框架,结合局部滑动地图与稀疏全局历史信息,通过新评估方法、聚类策略及维护拓扑地图实现高效搜索,性能优于现有方法。

Comments Accepted by IEEE Robotics and Automation Letters (RA-L), 2026. https://github.com/Poaos/SLIDER

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10544 2026-07-14 cs.CV 新提交 57%

Physics-inspired Pseudo Anomaly Generation and Prototype Feature Guidance for 3D Anomaly Detection

用于3D异常检测的物理启发式伪异常生成与原型特征引导

Jian Ning, Qin Zou, Linchun Wu, Yuanhao Yue, Kunmo Li, Shoubin Chen, Zhongyuan Wang

机构 * School of Computer Science, Wuhan University(武汉大学计算机科学学院) Guangdong Laboratory of Artificial Intelligence and Digital Economy (SZ)(广东省人工智能与数字经济实验室(深圳)) School of Information and Software Engineering, East China Jiaotong University(华东交通大学信息工程学院) School of Computer Science and Technology, Dalian University of Technology(大连理工大学计算机科学与技术学院)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 针对3D点云异常检测中真实异常样本稀缺等问题,提出PA3AD框架,采用物理启发式伪异常生成策略及原型特征引导,通过关键创新有效学习分布变化,实验证明其检测性能优于现有方法。

Comments 20 pages; already accepted by Pattern Recognition

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10461 2026-07-14 cs.CV cs.AI 新提交 57%

Annotation-Free Furniture Codes: What They Encode, and How Far They Transfer

无标注家具编码:它们编码了什么以及能转移多远

Benjamin Friedman

机构 * DLR Group(DLR集团)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 研究能否用源自物体几何形状的自监督令牌取代类别标签和规范姿态约定。通过对FSQ点云自动编码器进行倒角训练,发现编码能恢复多种信息,其旋转内容可由训练目标设置,跨资产库缩放时编码转移情况因类别而异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09947 2026-07-14 cs.RO 新提交 57%

A Numerically-Robust ROS 2 Port of iG-LIO: Diagnosing and Fixing Toolchain-Induced Failures in Incremental GICP LiDAR-Inertial Odometry

iG-LIO的数值稳健ROS 2端口:诊断和修复增量GICP激光雷达惯性里程计中工具链引起的故障

Afonso E. Carvalho, David Portugal, Paulo Peixoto

机构 * Robotics Institute (RI), Carnegie Mellon University (CMU)(卡内基梅隆大学机器人研究所) Institute of Systems and Robotics (ISR), University of Coimbra (UC)(科英布拉大学系统与机器人研究所)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 研究针对iG-LIO的ROS 2端口,诊断并修复由工具链导致的数值故障。通过分析QoS不匹配等问题,采取修正点场解析、添加传感器支持等方法,在多种传感器上验证了改进后的端口,为该端口提供了可引用参考。

Comments 3 pages, 1 figure, 4 references

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10008 2026-07-14 stat.ML cs.LG stat.ME 新提交 50%

Manifold Constrained Conformal Prediction for Spatial Events

空间事件的流形约束共形预测

Collin Nill, Trevor Harris, Jason Adams

机构 * Department of Statistics University of Connecticut(统计学系 美国康乃狄克大学) Sandia National Laboratories(桑地亚国家实验室)

专题命中 点云 :point cloud(abstract)

AI总结 该研究针对空间事件预测,提出基于将空间点云表示为经验测度,用(切片)瓦瑟斯坦距离评分,并约束预测集在训练数据流形附近的新共形预测方法,经实验其在覆盖及距离指标上优于基线。

Comments 21 pages, 10 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10530 2026-07-14 cs.CE 新提交 50%

Integrating Physics-Informed Neural Networks and 3D Vascular Geometry Learning for Cerebral Aneurysm Detection and Multimodal Rupture-Risk Prediction

将物理信息神经网络与3D血管几何学习相结合用于脑动脉瘤检测和多模态破裂风险预测

Eshan Vipuil, Xianqi Li

专题命中 点云 :point cloud(abstract)

AI总结 研究旨在结合物理信息神经网络与3D血管几何学习用于脑动脉瘤检测及多模态破裂风险预测。通过基于PointNeXt的检测器识别动脉瘤,利用物理信息神经网络生成血流动力学描述符,多模态模型整合多种变量预测风险,取得良好检测及预测效果,提供了定量多模态评估策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10570 2026-07-14 cond-mat.mes-hall 新提交 50%

Spectral-Domain Deep Learning of Intrinsic Scattering Operators for Arbitrarily Shaped Compact 3D Particles

用于任意形状紧凑三维粒子的本征散射算子的谱域深度学习

Daize Li, Jiafu Shen, Yifei Liu, Bonan Zhang, Heping Xie

专题命中 点云 :point cloud(abstract)

AI总结 研究任意形状三维粒子光学散射预测难题,提出双谱域神经散射模型,将粒子几何压缩为球谐系数,光学响应编码为T矩阵,经谱令牌变换器训练,能恢复模态结构、再现散射图,确立谱域算子学习为有效预测途径。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 3D生成 1 篇

2607.10826 2026-07-14 cs.CV cs.AI cs.GR 新提交 76%

3D-DefectBench: A Controlled Factorial Study of Vision-Language Model Evaluation Pipelines for Fine-Grained 3D Generation Defects

3D-缺陷基准:用于细粒度3D生成缺陷的视觉语言模型评估管道的控制因子研究

Zhenyu Zhao, Nanshan Jia, Jihyeon Je, Yifu Tang, Alvin Chan, Michael Spedden, Michael V. Palleschi, Sui Huang, Jingshen Wang, Zeyu Zheng

机构 * Roblox Corporation(罗布乐思公司) Berkeley AI Research Lab & Department of Industrial Engineering and Operations Research, University of California, Berkeley(加州大学伯克利分校伯克利人工智能研究实验室及工业工程与运筹学系) Computer Science Department, Stanford University(斯坦福大学计算机科学系) Division of Biostatistics, University of California, Berkeley(加州大学伯克利分校生物统计学系)

专题命中 3D生成 :3D generation(title);分类 cs.CV、cs.GR

AI总结 研究基于视觉语言模型的3D缺陷检测管道评估,引入3D-DefectBench基准框架,通过平衡因子设计改变多个管道因素进行实验,发现模型选择影响最大,各因素相互作用,还得出一些协议表现及评判与人工标注对比情况等结论。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 空间理解 1 篇

2607.10822 2026-07-14 cs.LG 新提交 50%

Graph Neural Networks for RFID-Based Spatial Geometry Inference in Spatial AI Systems

空间人工智能系统中基于 RFID 的空间几何推理的图神经网络

Curtis Shull, Merrick Green, Roy Rucker

专题命中 空间理解 :spatial understanding(abstract)

AI总结 针对室内空间理解难题,本文提出基于图神经网络的学习框架,整合信号强度等数据构建图表示,通过 GNN 训练预测空间几何模式,如线性轨迹等,为室内定位等提供新方法。

Comments 38 pages, 10 figures. Introduces a Graph Neural Network framework for RFID-based spatial geometry inference using indoor floorplan semantics and digital twin representations

详情

展开后加载摘要…

URL PDF HTML 收藏

6. SLAM与定位 2 篇

2607.10925 2026-07-14 cs.RO 新提交 74%

Mapping Pamir: Multi-Session Visual-Inertial SLAM and 3D Reconstruction of an Underwater Shipwreck

绘制帕米尔:水下沉船的多会话视觉惯性SLAM与3D重建

Michalis Chatzispyrou, Luke Horgan, Hyunkil Hwang, Harish Sathishchandra, Chinmay Burgul, Monika Roznere, Alberto Quattrini Li, Philippos Mordohai, Ioannis Rekleitis

机构 * University of Delaware(特拉华大学) Stevens Institute of Technology(史蒂文斯理工学院) Binghamton University(宾汉姆顿大学) Dartmouth College(达特茅斯学院)

专题命中 SLAM与定位 :3D reconstruction(title);分类 cs.RO

AI总结 该研究利用经济相机与潜水计算机数据,基于SVIn2和COLMAP框架,提出水下环境多会话映射框架,实现巴巴多斯海岸沉船的多会话映射,首次对沉船内外进行映射,第三个会话采用双相机拓宽视野。

Comments 8 pages, 12 figures. Accepted to ICRA 2026, Vienna, Austria

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09985 2026-07-14 cs.CV 新提交 57%

UniPose9D: Universal Category-Agnostic Object Pose Estimation

UniPose9D:通用的类别无关物体姿态估计

Yang You, Yi Du, Cole Harrison, Leonidas Guibas

机构 * Stanford University(斯坦福大学) Amazon(亚马逊)

专题命中 SLAM与定位 :3D vision(abstract);分类 cs.CV

AI总结 研究针对物体姿态估计中现有方法泛化性不足的问题,提出UniPose9D模型,通过采样点对、利用特定特征预测NOCS坐标,引入改进算法及流匹配,构建训练集,实验证明该模型能匹配或超越专业方法,泛化能力强。

详情

展开后加载摘要…

URL PDF HTML 收藏