arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-07-13 至 2026-07-13 共收录 9 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 4 篇

2607.09455 2026-07-13 cs.CV cs.RO 新提交 62%

Hydra++: Real-Time Hierarchical 3D Scene Graph Construction With Object-Level Shape Estimation

Hydra++:通过对象级形状估计进行实时分层3D场景图构建

Hyungtae Lim, Nathan Hughes, Xihang Yu, Ruihan Xu, Yun Chang, Jingnan Shi, Rajat Talak, Luca Carlone

机构 * Laboratory for Information & Decision Systems, Massachusetts Institute of Technology(信息与决策系统实验室,麻省理工学院)

专题命中 三维重建 :point cloud(abstract);分类 cs.CV、cs.RO

AI总结 研究如何将基于学习的对象形状估计器集成到分层3D场景图管道中,提出Hydra++系统。它结合形状估计和一致性检查,默认配置可在线构建场景图,支持混合配置应对室外挑战,实验证明其提高了对象和场景级重建质量。

Comments 8 pages, 12 figures, accepted in Proc. IEEE/RSJ IROS

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09503 2026-07-13 cs.CV cs.AI 新提交 57%

What VGGT Knows About Overlap: Probing Geometric Foundation Models for Co-Visibility

VGGT 对重叠的理解:探索共可见性的几何基础模型

Filippo Ziliotto, Luciano Serafini, Lamberto Ballan, Tommaso Campari

机构 * University of Padova(帕多瓦大学) Fondazione Bruno Kessler (FBK)(布鲁诺·凯斯勒基金会)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 研究三维重建和机器人定位中共可见性问题,通过探索 VGGT 模型,发现其隐式编码共可见性及层间特性,引入 Co-VGGT 方法,该方法冻结 VGGT 并训练轻量级头,在基准测试中表现出色,提升了共可见性分类效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09225 2026-07-13 cs.CV 新提交 57%

Glob3R: Global Structure-from-Motion with 3D Foundation Models

Glob3R:基于3D基础模型的全局运动恢复结构

Junyuan Deng, Heng Li, Kejie Qiu, Lingteng Qiu, Rui Peng, Weichao Shen, Weihao Yuan, Siyu Zhu, Zilong Dong, Ping Tan

机构 * The Hong Kong University of Science and Technology(香港科技大学) Tongyi Lab, Alibaba Group(阿里巴巴集团通义实验室) Nanjing University(南京大学) Fudan University(复旦大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 研究针对3D基础模型重建结果不准确及处理长序列或大图像集有缺陷的问题,提出Glob3R方法,通过增强主干、转换扭曲为特征轨迹、引入关联策略及进行全局优化等,实现强大准确重建,提升神经渲染质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09125 2026-07-13 cs.CV 新提交 57%

4D Human-Scene Reconstruction from Low-Overlap Captures

从低重叠度捕获中进行4D人体场景重建

Minhyuk Hwang, Sangmin Kim, Seunguk Do, Daneul Kim, Jaesik Park

机构 * Seoul National University(首尔国立大学)

专题命中 三维重建 :novel view synthesis(abstract);分类 cs.CV

AI总结 针对现实场景中低重叠度相机的4D人体场景重建问题,提出StudioRecon方法,通过解耦背景和人体,利用视频扩散模型强化背景监督,结合跨视图关联等初始化人体,经递归增强模块避免伪影,实现了高水准新视图合成及相关应用。

Comments Accepted to SIGGRAPH Conference Papers '26. First two authors contributed equally. Project page: https://sisyphm.github.io/studiorecon-page/

详情

展开后加载摘要…

URL PDF HTML 收藏

2. Gaussian Splatting 3 篇

2607.08808 2026-07-13 cs.CV 新提交 89%

StereoSplat+: Feed-Forward Stereo Gaussian Splatting with Diffusion-Assisted Progressive Inference

StereoSplat+:具有扩散辅助渐进推理的前馈立体高斯点云渲染

Zihua Liu, Masatoshi Okutomi

机构 * Institute of Science Tokyo(东京科学研究所)

专题命中 Gaussian Splatting :3DGS(summary_cn,abstract);Gaussian Splatting(title,abstract);分类 cs.CV

AI总结 研究从单目立体观察恢复高质量3DGS场景的问题,提出StereoSplat+框架,包含StereoSplat估计器及扩散增强单步渐进推理方案,实验表明该方法提升了新视图渲染质量和几何精度,优于现有前馈3DGS基线。

Comments 8 pages, accepted as a conference paper for IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00321 2026-07-13 cs.CV 新提交 81%

CORGI: Consistency-Aware 3D Dog Reconstruction from a Single Image in the Wild

CORGI: 从野外单张图像进行一致性感知的3D狗重建

Yuxiao Wu, Weile Li, Boyi Zhu, Yumeng Liu, Youcheng Cai, Ligang Liu

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 Gaussian Splatting :3DGS(summary_cn,abstract);分类 cs.CV

AI总结 提出CORGI框架,通过规范驱动轨道生成、一致性感知可变形3DGS和自监督变形条件生成修复模块,从单张无约束图像重建高保真3D狗模型,无需3D监督。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08948 2026-07-13 cs.RO cs.CV 新提交 62%

SplatCtrl: Perception-Action Coupling via Gaussian Scene Representations and Reactive Robot Control

SplatCtrl:通过高斯场景表示和反应式机器人控制实现感知-动作耦合

Siddarth Jain, Ho Jin Choi

机构 * Mitsubishi Electric Research Laboratories (MERL)(三菱电机研究实验室) University of Pennsylvania(宾夕法尼亚大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV、cs.RO

AI总结 针对机器人在非结构化动态环境控制难题,提出SplatCtrl框架。基于3D高斯溅射,引入混合滤波和重定位策略用于场景重建,还提出从高斯推导距离函数的方法,纳入控制障碍函数,实现感知-动作耦合,经实验验证有效。

Comments Published in 2026 International Conference on Robotics and Automation (ICRA). 8 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 点云 2 篇

2607.09315 2026-07-13 cs.RO 新提交 57%

Robot Trajectron V3: A Probabilistic Shared Control Framework for SE(3) Manipulation

机器人轨迹生成器V3:一种用于SE(3)操作的概率共享控制框架

Pinhao Song, Zhongxi Li, Ze Fu, Federico Ulloa Rios, Renaud Detry

机构 * KU Leuven(鲁汶大学) Flanders Make(法兰德斯制造)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 针对远程操作机器人手臂执行高自由度操作任务的难题(认知要求高、易出错、依赖低带宽接口),提出概率共享控制框架RT-V3,通过贝叶斯推理结合用户意图先验与实时命令估计后验分布,实验证明其在多方面表现出色,优于基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09026 2026-07-13 math.ST cs.DS math.PR stat.TH 新提交 50%

Geometric planted matchings in high dimensions: The power of multiple views

高维几何植入匹配:多视图的力量

Timothy L. H. Wee, Kaylee Y. Yang, Zhou Fan, Cheng Mao

专题命中 点云 :point cloud(abstract)

AI总结 研究\(\mathbb{R}^d\)中\(n\)个点与噪声置换版本的对应关系恢复问题,高维下\(b = 2\)是阈值。证明\(b < 2\)时无估计器能有效恢复。多视图推广中,\(b > K/(K - 1)\)时简单过程可恢复匹配,打破\(b = 2\)障碍。

详情

展开后加载摘要…

URL PDF HTML 收藏