arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-08-04 至 2026-08-04 共收录 17 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 5 篇

2510.10726 2026-08-04 cs.CV 版本更新 70%

WorldMirror: Universal 3D World Reconstruction with Any-Prior Prompting

WorldMirror:基于任意先验提示的通用三维世界重建

Yifan Liu, Zhiyuan Min, Zhenwei Wang, Junta Wu, Tengfei Wang, Yixuan Yuan, Yawei Luo, Chunchao Guo

机构 * Zhejiang University(浙江大学) Chinese University of Hong Kong(香港中文大学) Tencent Hunyuan(腾讯混元)

专题命中 三维重建 :point cloud(abstract);novel view synthesis(abstract);分类 cs.CV

AI总结 本研究提出WorldMirror这一统一前馈模型,可整合多种几何先验并生成多种三维表示,在多类三维几何任务的基准测试中达到最优性能且推理效率高。

Comments Accepted to ICML 2026. Code: https://github.com/Tencent-Hunyuan/HunyuanWorld-Mirror Project page: https://3d-models.hunyuan.tencent.com/world/

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.06945 2026-08-04 cs.CV 版本更新 70%

Direct and Adaptable Mesh-Gaussian Scene Reconstruction from Multi-View Images

从多视图图像进行直接且可自适应的网格-高斯场景重建

Ancheng Lin, Tianqing Su, Zuo Yuan, Quanke Su, Samuel S. Mao, Yusheng Xiang

机构 * School of Computer Science, Australian Artificial Intelligence Institute (AAII)(计算机科学学院,澳大利亚人工智能研究所) University of Technology Sydney(悉尼技术大学) School of Automobile(汽车学院) Chang’an University(长安大学)

专题命中 三维重建 :3DGS(abstract,abstract_cn);分类 cs.CV

AI总结 该研究针对现有方法分离几何与外观建模的问题,提出端到端网格-高斯场景表示,实现直接联合学习,提升重建效率与质量,可高效适配局部场景修改,支撑具身智能相关环境维护。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24852 2026-08-04 cs.CV cs.RO 版本更新 62%

Track-Leakage-Free Hold-Out Self-Validation for Photogrammetric Reconstruction: Protocol, Sensitivity, and Limits

用于摄影测量重建的无轨迹泄漏留出法自验证:协议、敏感性和局限性

Behnam Asadi

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV、cs.RO

AI总结 研究摄影测量重建在无地面真值时估计自身可靠性的问题,提出无轨迹泄漏留出协议,通过特定图像子集和3D点重新定位计算mAA置信度,发现该协议能测内部几何一致性,但非绝对精度,不可替代控制点评估和严重失败门限。

Comments 16 pages, 4 figures. v3: code, harness and result tables archived at Zenodo (doi:10.5281/zenodo.21737748); adds related-work discussion of RayZer/E-RayZer; worked example now computed by the released script; results unchanged. Negative/characterisation result: a ground-truth-free self-consistency signal saturates and is blind to coherent global distortion

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28261 2026-08-04 cs.CV 版本更新 57%

TARS: Timestep-Aware Data Scaling for 3D-Free Video Re-Shooting

TARS:用于无3D视频重拍摄的时间步感知数据缩放

Jiwen Liu, Shujuan Li, Xiaohan Li, Zijie Meng, Xinyue Liu, Yulong Xu, Yan Zhou, Guoxin Zhang

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 该研究提出无3D的视频重拍摄范式TARS,通过自监督学习结合数据缩放与文本-相机联合条件设置,实现稳健的相机与视角控制,在大运动下合成未见区域的表现优于现有方法。

Comments 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24024 2026-08-04 cs.CV 版本更新 57%

GeoStereo: A Unified Stereo Geometry Estimation Framework for Disparity and Surface Normal

用于视差和表面法线的统一立体几何估计框架

Qizhe Wei, Xianda Guo, Shaocong Xu, Hong Li, Runyi Yang, Hao Zhao

机构 * Beijing Institute of Technology(北京理工大学) School of Computer Science, Wuhan University(武汉大学计算机科学学院) Beihang University(北京航空航天大学) INSAIT, Sofia University(索非亚大学INSAIT) BAAI AIR, Tsinghua University(清华大学BAAI AIR)

专题命中 三维重建 :3D vision(abstract);分类 cs.CV

AI总结 本文针对立体匹配和表面法线估计问题,提出统一框架GeoStereo,结合前馈立体匹配与基于扩散的法线估计分支,引入初始化策略与扭曲条件,实现有效交互,在多场景表现可靠,零样本设置下视差和法线估计精度高。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. Gaussian Splatting 4 篇

2508.05950 2026-08-04 cs.CV cs.AI 版本更新 89%

CLONE: Continuous Latent Optimization for Normal Estimation via 3D Gaussian Splatting

CLONE: 基于3DGS的闭环可微优化框架用于单图像法线估计

Yanxing Liang, Yinghui Wang, Wei Li, Tao Yan, Jiaxing Shen

机构 * School of Artificial Intelligence and Computer Science, Jiangnan University, Wuxi, China(江南大学人工智能与计算机科学学院,中国无锡) School of Data Science, Lingnan University, Hong Kong, China(岭南大学数据科学学院,中国香港)

专题命中 Gaussian Splatting :3DGS(title_cn,abstract);Gaussian Splatting(title,abstract);分类 cs.CV

AI总结 提出CLONE框架,通过3D高斯泼溅参数化场景并利用协方差特征分解得到连续可微法线,结合可微光照模型和一步确定性扩散精化网络,在统一重投影目标下联合优化,实现无需真值法线监督的几何一致性单图像法线估计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14990 2026-08-04 cs.CV 版本更新 83%

JADE-GS: Joint Allocation of Deblurring Evidence for Event-Assisted 3D Gaussian Splatting

JADE-GS:3D高斯点云渲染中基于事件引导的联合交替去模糊

Haoyu Fu, Jiafeng Huang, Yuchen Wang, Shengjie Zhao

机构 * School of Mechatronic Engineering and Automation, Shanghai University(上海大学机电工程与自动化学院) Shanghai Baoshan Shangda General Intelligent Robotics Research Institute(上海宝山尚大通用智能机器人研究院) School of Computer Science and Technology, Tongji University(同济大学计算机科学与技术学院)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract);分类 cs.CV

AI总结 研究相机快速移动曝光时模糊问题,提出JADE-GS方法,通过像素自适应路由门融合互补先验,2D恢复器与3D高斯点云渲染双向循环耦合,正则化恢复器,在合成和真实基准测试中获最佳感知质量,训练高效且保留实时渲染。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25129 2026-08-04 cs.CV 版本更新 83%

AirSplat: Alignment and Rating for Robust Feed-Forward 3D Gaussian Splatting

AirSplat:基于鲁棒前馈3D高斯散射的对齐与评分

Minh-Quan Viet Bui, Jaeho Moon, Munchurl Kim

机构 * KAIST(韩国科学技术院)

专题命中 Gaussian Splatting :Gaussian Splatting(title);3D vision(abstract);novel view synthesis(abstract);分类 cs.CV

AI总结 本文提出AirSplat框架,通过自一致性姿态对齐和基于评分的透明度匹配技术,提升无姿态视角合成的重建质量。

Comments Project page: https://kaist-viclab.github.io/airsplat-site, accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11500 2026-08-04 cs.CV 版本更新 57%

HyperGS: Fast and Generalizable Gaussian Video Representation

HyperGS:快速且通用的高斯视频表示

Fatimah Zohra, Chen Zhao, Shuming Liu, Yahya Al Malallah, Bernard Ghanem

机构 * King Abdullah University of Science and Technology (KAUST)(阿卜杜拉国王科技大学) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳))

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV

AI总结 研究针对高斯视频表示中现有方法依赖单视频优化、编码慢且通用性受限的问题,提出HyperGS方法,通过设计特定Transformer提取令牌和获得高斯表示,结合正则化器解决退化问题,实现快速编码及跨视频通用,提升了PSNR。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 点云 6 篇

2603.21611 2026-08-04 cs.CV 版本更新 57%

SARe: Structure-Aware Generative 3D Fragment Reassembly

SARe: 基于结构的大规模3D碎片重组

Hanze Jia, Chunshi Wang, Yuxiao Yang, Zhonghua Jiang, Yawei Luo, Shuainan Ye, Tan Tang

机构 * State Key Lab of CAD\&CG, Zhejiang University(浙江大学CAD与计算机图形学国家重点实验室) School of Software Technology, Zhejiang University(浙江大学软件学院) Laboratory of Art and Archaeology Image, Zhejiang University(浙江大学艺术与考古图像实验室)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文提出SARe框架,通过生成式方法解决大规模3D碎片重组问题,通过显式接触建模提高接触推理的稳定性与一致性,实验证明在碎片数量增加时具有更优的性能。

Comments 9 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02457 2026-08-04 cs.CV 版本更新 57%

PatchAlign3D: Local Feature Alignment for Dense 3D Shape Understanding

PatchAlign3D: 本地特征对齐用于密集3D形状理解

Souhail Hadgi, Bingchen Gong, Ramana Sundararaman, Emery Pierson, Lei Li, Peter Wonka, Maks Ovsjanikov

机构 * École polytechnique(巴黎政治学院) University of Virginia(弗吉尼亚大学) KAUST(王国立阿联酋科技大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 PatchAlign3D通过点云直接生成语言对齐的片段特征,实现高效零样本3D部分分割,优于传统渲染方法。

Comments CVPR 2026. Project website: https://souhail-hadgi.github.io/patchalign3dsite/

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03011 2026-08-04 cs.RO 版本更新 57%

3D-CovDiffusion: 3D-Aware Diffusion Policy for Coverage Path Planning

3D-CovDiffusion:面向覆盖路径规划的三维感知扩散策略

Chenyuan Chen, Haoran Ding, Ran Ding, Tianyu Liu, Zewen He, Anqing Duan, Yoshihiko Nakamura

机构 * IEEE

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 本文提出 3D-CovDiffusion,将覆盖路径规划转化为条件序列生成问题,采用几何条件扩散框架从三维点云合成轨迹,相比基线方法在轨迹平滑度、覆盖率等指标上实现显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18819 2026-08-04 cs.CV 版本更新 57%

Parameter-Efficient CLIP Adaptation for 3D Understanding via Unified Tokenization

用于3D理解的参数高效CLIP适配:通过统一分词实现

Guofeng Mei, Qinfeng Xiao, Bin Ren, Luigi Riz, Juan Liu, Xiaoshui Huang, Xu Zheng, Nicu Sebe, Ming-Hsuan Yang, Fabio Poiesi

机构 * Fondazione Bruno Kessler(布鲁诺·科塞拉基金会) University of Trento(特伦托大学) University of Pisa(比萨大学) Beijing Forestry University(北京林业大学) Shanghai Jiao Tong University(上海交通大学) Hong Kong University of Science and Technology (GZ)(香港科技大学) Shandong University(山东大学) University of California, Merced(加州大学默塞德分校)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文提出参数高效框架UTok3D,通过学习尺度归一化3D分词器,实现冻结CLIP视觉主干在无标注情况下对不同尺度点云的复用,完成3D分割任务。

Comments 14 pages, tokenizer

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01498 2026-08-04 math.NA cs.NA 版本更新 50%

Geometric Generalization of Neural Operators from a Kernel Integral Perspective

从核积分视角看神经算子的几何泛化

Mingyu Han, Daniel Zhengyu Huang, Yuhan Wang, Yanshu Zhang, Jiayi Zhou

专题命中 点云 :point cloud(abstract)

AI总结 本文提出一种基于核积分视角的多尺度神经算子,用于解决变量几何下的神经算子泛化问题,并提供理论保证和实验验证。

Comments 37 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.17494 2026-08-04 math.AT math.OC 版本更新 50%

Topological feature selection for time series data

面向时间序列数据的拓扑特征选择

Peter Bubenik, Johnathan Bush

专题命中 点云 :point cloud(abstract)

AI总结 该研究将应用拓扑学工具用于时间序列数据的特征选择,提出一种基于拓扑特征贡献的变量评分方法,以秀丽隐杆线虫神经元数据为背景,选出优化协同动力学的神经元子集。

Comments 31 pages. Numerous improvements based on referee comments. We now use stochastic subgradient descent which has guarantees of convergence

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 空间理解 1 篇

2607.17999 2026-08-04 cs.AI cs.CV 版本更新 79%

Do Maps Still Matter for Machines: Revisiting the Role of Choropleth Maps in Foundation Model Spatial Understanding

地图对机器来说仍然重要吗:重新审视分级统计图在基础模型空间理解中的作用

Zhiwei Wei, Yonghe Sun, Zhenjia Liu, Wenjia Xu, Chao He, Weihua Dong, Chunbo Liu, Hua Liao

专题命中 空间理解 :spatial understanding(title,abstract);分类 cs.CV

AI总结 研究探讨分级统计图对基础模型空间理解的作用,引入ChoroplethMap-Bench基准,在三种输入条件下评估22个模型,发现地图能显著提升空间推理,尤其结合符号数据及高层次空间模式理解任务时,证明地图是基础模型空间推理的重要外部表示。

Comments 34 pages, 4 figures, and 10 tables

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 其他3D视觉 1 篇

2607.06216 2026-08-04 cs.CV 版本更新 57%

MoWorld: A Flash World Model

MoWorld:一种快速世界模型

Team Moxin, Deyi Ji, Tianrun Chen, Xin Zhang, Jiale Yang, Qi Zhu, An Zhao, Zihao Xie, Han Wang, Xuanyi Liu, Yixiang Zhou, Pei Liu, Yi Tan, Cheng Chen, Dayi Zhu, Mingyu Wei, Hanjie Xu, Jun Liao, Siqi Li, Lingyu Lu, Hongye Fang, Hongming Tan, Youjiang Zhu, Taiyu Zhang, Zejian Li, Chaotao Ding, Zhipeng Liang, Wenxuan Song, Yi Li, Baochuan Yang, Xin Jiang, Ben Feng, Jingyuan Zou, Yanlin Liu, Rong Shi, Lingfeng Li, Liyi Yao, Lanyun Zhu, Yunhe Pan, Lingyun Sun

机构 * Moxin Technology(魔心科技)

专题命中 其他3D视觉 :3D vision(abstract);分类 cs.CV

AI总结 研究旨在提升世界模型实用性与推理效率。提出MoWorld,基于3D原生数据引擎,有课程跨帧预训练等策略,能在NPU上达50 FPS实时交互,平均推理成本低,为世界模型大规模应用提供基础并展示多种应用。

Comments Project Page: https://moxin-tech.github.io/moworld/

详情

展开后加载摘要…

URL PDF HTML 收藏