arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-06-11 至 2026-06-11 共收录 22 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 2 篇

2606.12340 2026-06-11 cs.CV 新提交 57%

Echoes of the Prior: A Computational Phenomenology of Forgetting

先验的回响:遗忘的计算现象学

Gege Gao, Bernhard Schölkopf, Andreas Geiger

机构 * Eberhard Karl University of Tübingen(蒂宾根大学) Max Planck Institute for Intelligent Systems(马克斯·普朗克智能系统研究所) Tübingen AI Center(蒂宾根人工智能中心)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 通过在前馈3D重建模型中诱导突触衰减,可视化遗忘的主观现象学,将神经网络作为认知代理探索神经形态美学。

Journal ref Proc. ACM Comput. Graph. Interact. Tech, ACM SIGGRAPH, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11805 2026-06-11 cs.CV cs.AI 新提交 57%

TextHOI-3D: Text-to-3D Hand-Object Interaction via Discrete Multi-View Generation and Joint Mesh Optimization

TextHOI-3D: 基于离散多视图生成与联合网格优化的文本到三维手物交互

Zixiong Hao, Zhencun Jiang

机构 * Technical University of Munich(慕尼黑工业大学) Tongji University(同济大学) Shanghai Research Institute for Intelligent Autonomous Systems(上海自主智能无人系统科学中心)

专题命中 三维重建 :3D generation(abstract);分类 cs.CV

AI总结 提出TextHOI-3D框架,通过多视图离散表示连接文本生成与几何恢复,实现文本驱动的三维手物网格生成,显著降低物体倒角距离和穿透体积。

Comments 11 pages, 8 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏

2. Gaussian Splatting 5 篇

2606.11841 2026-06-11 cs.CV 新提交 89%

Scene-Adaptive Nonlinear Tone Curves for Pseudo Ground-Truth Generation in Low-Light 3D Gaussian Splatting

面向低光照3D高斯泼溅的场景自适应非线性色调曲线伪地面真值生成

Mingzhe Lyu, Jinqiang Cui, Hong Zhang

机构 * Southern University of Science and Technology(南方科技大学) Pengcheng Laboratory(鹏城实验室)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract,abstract_cn);3D reconstruction(abstract);novel view synthesis(abstract)

AI总结 针对低光照3D重建中伪地面真值生成问题,提出场景自适应非线性色调曲线框架,通过两种曲线(ASE和AP3)替代线性增益,在三个基准上PSNR提升最高4.34dB。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11782 2026-06-11 cs.CV 新提交 85%

Seeing What Matters: Perceptual Wrapper with Common Randomness for 3D Gaussian Splatting

看见重要之处:基于公共随机性的感知包装器用于3D高斯泼溅

He-Bi Yang, Jing-Zhong Chen, Yen-Kuan Ho, Sang NguyenQuang, Fan-Yi Hsu, Yun-Yu Lee, Jui-Chiu Chiang, Wen-Hsiao Peng

机构 * National Yang Ming Chiao Tung University(国立阳明交通大学) National Chung Cheng University(国立中正大学)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract,abstract_cn);分类 cs.CV

AI总结 针对3D高斯泼溅在内存受限和率失真优化管道中高频纹理合成困难的问题,提出一种2D感知包装器,利用伪随机高斯噪声和Wasserstein失真监督,以内容与视角相关的方式增强渲染输出,显著提升感知质量并压缩模型大小。

Comments 18 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11529 2026-06-11 cs.GR cs.CV cs.PF 新提交 85%

XPR: An Extensible Cross-Platform Point-Based Differentiable Renderer

XPR:一个可扩展的跨平台基于点的可微分渲染器

Steve Rhyner, Sankeerth Durvasula, Aleksandr Kovalev, Hansel Jia, Adrian Zhao, Mrutunjayya Mrutunjayya, Nilesh Ahuja, Selvakumar Panneer, Christina Giannoula, Nandita Vijaykumar

机构 * University of Toronto(多伦多大学) Vector Institute(向量研究所) Intel(英特尔) Max Planck Institute for Software Systems(马克斯·普朗克软件系统研究所)

专题命中 Gaussian Splatting :3DGS(summary_cn,abstract);3D reconstruction(abstract);分类 cs.CV、cs.GR

AI总结 提出XPR框架,通过高级编程接口和模块化渲染管线,支持用少量代码实现3DGS等新方法,并利用XLA编译器跨平台运行。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11390 2026-06-11 cs.CV cs.DC cs.GR cs.LG 新提交 81%

A Scalable PyTorch Abstraction for Multi-GPU Gaussian Splatting

一种可扩展的多GPU高斯泼溅PyTorch抽象

Matthew Cong, Francis Williams, Jonathan Swartz, Mark Harris, Sanja Fidler, Ken Museth

机构 * NVIDIA(英伟达) University of Toronto(多伦多大学) Vector Institute(向量研究所)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);分类 cs.CV、cs.GR

AI总结 提出一种多GPU高斯泼溅方法,通过CUDA统一内存和NVLink在算子级别分布参数,实现大规模场景重建,支持超过10亿高斯泼溅。

Comments 14 pages, 6 tables, 2 figures, and 1 listing. Includes supplementary material

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11314 2026-06-11 cs.CV cs.GR 新提交 62%

TRON: Tracing Rays to Orchestrate a Neural Renderer for 3D Gaussian Reconstructions

TRON:追踪光线以编排用于3D高斯重建的神经渲染器

Or Perel, Hassan Abu Alhaija, Zian Wang, Jacob Munkberg, Matan Atzmon, Sanja Fidler, Masha Shugrina

机构 * NVIDIA(英伟达) University of Toronto(多伦多大学) Vector Institute(向量研究所)

专题命中 Gaussian Splatting :3D reconstruction(abstract);分类 cs.CV、cs.GR

AI总结 提出TRON框架,结合3D高斯光线追踪与神经渲染,实现真实世界3D场景在新光照、动态物体运动、物体插入和材质编辑下的逼真可控渲染,通过内在分解先验和光线追踪辐射引导,弥合物理渲染与神经渲染的差距。

Comments Project page: https://research.nvidia.com/labs/sil/projects/tron/

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 点云 8 篇

2606.12189 2026-06-11 cs.CV 新提交 79%

DynaTok: Token-Based 4D Reconstruction from Partial Point Clouds

DynaTok: 基于Token的部分点云4D重建

Weirong Chen, Keisuke Tateno, Hidenobu Matsuki, Michael Niemeyer, Daniel Cremers, Federico Tombari

机构 * Technical University of Munich(慕尼黑工业大学) Google(谷歌) Imperial College London(伦敦帝国理工学院) University of Bonn(波恩大学)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 提出DynaTok框架,通过Transformer时空编码器和流匹配解码器,从部分点云序列中无对应地重建完整且时间一致的4D点云,无需图像。

Comments ICML 2026. Project page: https://wrchen530.github.io/dynatok/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12048 2026-06-11 cs.RO 新提交 79%

Point Cloud Segmentation for Autonomous Clip Positioning in Laparoscopic Cholecystectomy on a Phantom

用于腹腔镜胆囊切除术中自动夹子定位的点云分割(在体模上)

Balázs Gyenes, Nikolai Franke, Paul Maria Scheikl, Pit Henrich, Rayan Younis, Gerhard Neumann, Martin Wagner, Franziska Mathis-Ullrich

机构 * Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院) HIDSS4Health - Helmholtz Information and Data Science School for Health(亥姆霍兹信息与数据科学健康学校) Friedrich-Alexander-University, Erlangen-Nuremberg(弗里德里希-亚历山大大学埃尔朗根-纽伦堡) University Hospital Carl Gustav Carus and Centre for Tactile Internet with Human-in-the-loop (CeTI), Dresden University of Technology(卡尔·古斯塔夫·卡鲁斯大学医院及德累斯顿工业大学触觉互联网人机共融卓越中心)

专题命中 点云 :point cloud(title,abstract);分类 cs.RO

AI总结 提出首个在腹腔镜手术体模上实现自主夹子定位的机器人系统,通过点云分割和样条插值提取目标位置,利用合成数据预训练和两种数据增强克服数据稀缺,达到0.75mm精度和100%成功率。

Comments 8 pages, 5 figures, accepted to IEEE Robotics and Automation Letters (RAL)

Journal ref IEEE Robotics and Automation Letters (Volume: 10, Issue: 8, August 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11466 2026-06-11 cs.CV 新提交 79%

PT-WNO: Point Transformer with Wavelet Neural Operator for 3D Point Cloud Semantic Segmentation

PT-WNO: 结合小波神经算子的点Transformer用于3D点云语义分割

Nhut Le, Maryam Rahnemoonfar

机构 * Lehigh University(里海大学)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 针对点云语义分割中全局上下文不足的问题,提出PT-WNO,通过在跳跃连接旁集成可学习的小波神经算子分支捕获多尺度全局频谱上下文,在四个基准上提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11578 2026-06-11 cs.CV 新提交 61%

Contactless 3D Human Body Measurement Using Depth Cameras for Smart Health Monitoring

基于深度相机的非接触式3D人体测量用于智能健康监测

Martha Asare, Xuan Wang, Juan Lopez Alvarenga, Lois Akosua Serwaa, Jinghao Yang

机构 * Department of Computer(计算机系) Department of Information(信息系) Department of Human Genetics(人类遗传学系) University of Texas Rio Grande Valley(德克萨斯大学里奥格兰德谷分校) Department of Electrical and Computer Engineering(电气与计算机工程系)

专题命中 点云 :point cloud(abstract,comments);分类 cs.CV

AI总结 提出一种基于深度相机和3D点云的非接触式人体测量框架,通过空间滤波、地标选择及体素/网格分析实现身高、臂展、体积和表面积等关键指标的准确估计。

Comments 6 pages, 4 figures. Depth camera-based framework for contactless anthropometric measurement and geometric analysis using 3D point clouds

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12334 2026-06-11 cs.LG cs.RO 新提交 57%

Fourier Features Let Agents Learn High Precision Policies with Imitation Learning

傅里叶特征让智能体通过模仿学习学习高精度策略

Balázs Gyenes, Emiliyan Gospodinov, Jan Frieling, Enrico Krohmer, Nicolas Schreiber, Xiaogang Jia, Niklas Freymuth, Gerhard Neumann

机构 * Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院) FZI Research Center for Information Technology(FZI信息技术研究中心)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 提出在点云编码器中使用傅里叶特征映射,解决神经网络低频偏好导致的高精度操作问题,在多个基准和真实机器人上显著提升性能。

Comments Published as a conference paper at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11708 2026-06-11 cs.RO 新提交 57%

Explore From Sketch: Accelerating UAV Exploration in Large-scale Environments with Prior Maps

从草图探索:利用先验地图加速无人机在大规模环境中的探索

Tiancheng Lai, Yuman Gao, Xiangyu Li, Ruitian Pang, Xingpeng Wang, Siqi Shen, Mengke Zhang, Yin He, Fei Gao, Chao Xu, Yanjun Cao

机构 * Institute of Cyber-Systems and Control, College of Control Science and Engineering, Zhejiang University(浙江大学控制科学与工程学院工业控制技术研究所) Huzhou Institute, Zhejiang University, and Huzhou Key Laboratory of Autonomous System(浙江大学湖州研究院,湖州市自主系统重点实验室) Zhejiang Zhongyan Industry Co., Ltd(浙江中烟工业有限责任公司) Differential Robotics Technology Company(微分机器人技术有限公司)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 提出利用稀疏、未对齐甚至不一致的2D先验地图加速无人机大规模环境探索的框架,通过鲁棒的2D-3D点云配准和层次化视点规划,实现效率提升34.2%。

Comments 25 pages, 22 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12146 2026-06-11 cs.LG cs.AI 新提交 50%

nD-RoPE: A Generalized RoPE for n-Dimensional Position Embedding

nD-RoPE:一种用于n维位置嵌入的广义RoPE

Boyang Li, Yulin Wu, Sizhe Xu, Nuoxian Huang, Zhonghang Yuan, Shangyi Guo, Shu Yang, Takahiro Yabe

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 点云 :point cloud(abstract)

AI总结 提出nD-RoPE,将旋转位置嵌入推广到任意维度,通过多尺度正则单纯形波矢设计实现各向同性,在图像、视频和点云任务中提升性能。

Comments Accepted to the 43rd International Conference on Machine Learning (ICML 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11911 2026-06-11 stat.ML cs.LG math.AT 新提交 50%

From Persistence to Survival: Hypothesis Testing, Effect Sizes and Vectorisation for Topological Features

从持续性到生存:拓扑特征的假设检验、效应大小与向量化

Juliette Murris, Bernadette Stolz, Karsten Borgwardt

机构 * Department of Machine Learning and Systems Biology, Max Planck Institute of Biochemistry, Martinsried, Germany(机器学习与系统生物学部门,马克斯·普朗克生物化学研究所,马尔廷斯里德,德国)

专题命中 点云 :point cloud(abstract)

AI总结 提出STRAND方法,将持久性图视为生存数据,利用持久性生存函数统一实现假设检验、效应大小计算和向量化,在合成数据和真实基准上验证了有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 3D生成 3 篇

2606.12099 2026-06-11 cs.CV 新提交 79%

ISAP-3D: Identity-Slot Aligned Part-Aware 3D Generation

ISAP-3D: 身份槽对齐的部件感知3D生成

Junlin Hao, Haoshuai Fu, Xibin Song, Wei Li, Ruigang Yang, Xinggong Zhang, Jinchuan Zhang

机构 * Peking University(北京大学) Tencent(腾讯) Huawei(华为) University of Science and Technology of China(中国科学技术大学)

专题命中 3D生成 :3D generation(title,abstract);分类 cs.CV

AI总结 针对部件感知3D生成中因身份-布局纠缠导致的结构歧义问题,提出身份槽对齐框架ISAP-3D,通过语义身份令牌锚定每个部件并进行一对一布局预测,实现稳定可控的部件级3D生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11152 2026-06-11 cs.CV 版本更新 79%

P3D-Bench: Benchmarking MLLMs for Parametric 3D Generation and Structural Reasoning

P3D-Bench:用于参数化3D生成与结构推理的多模态大语言模型基准

Yikang Yang, Zhanpeng Hu, Youtian Lin, Mengqi Zhou, Jingxi Xu, Feihu Zhang, Jiaheng Liu, Yao Yao

机构 * Nanjing University(南京大学) Envision

专题命中 3D生成 :3D generation(title,abstract);分类 cs.CV

AI总结 提出P3D-Bench基准,通过参数化3D程序评估多模态大语言模型在几何精度、语义对齐和装配一致性上的表现,涵盖文本到3D、图像到3D和装配3D三类任务。

Comments Project page: https://spatiaos.github.io/projects/P3D-Bench

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11446 2026-06-11 cs.CV cs.GR 新提交 73%

3D-CBM: A Framework for Concept-Based Interpretability in Generative 3D Modeling

3D-CBM:生成式3D建模中基于概念可解释性的框架

Ahmad Al-Kabbany

机构 * Yubree Labs Multimedia Interaction and Communication Lab, Arab Academy for Science and Technology(阿拉伯科学技术学院多媒体交互与通信实验室)

专题命中 3D生成 :point cloud(abstract);3D generation(abstract);分类 cs.CV、cs.GR

AI总结 提出将概念瓶颈模型(CBM)融入3D生成架构,通过多层级可解释原语和功能属性映射,实现语义可操控的3D生成,实验验证了高概念预测精度和交互式纠错能力。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 空间理解 2 篇

2606.10401 2026-06-11 cs.CV 版本更新 57%

CoCoSI: Collaborative Cognitive Map Construction for Spatial Intelligence

CoCoSI: 面向空间智能的协作认知地图构建

Yiming Zhang, Ruoxuan Cao, Zhihang Zhong

机构 * Shanghai Jiao Tong University(上海交通大学) Cornell University(康奈尔大学)

专题命中 空间理解 :spatial understanding(abstract);分类 cs.CV

AI总结 提出一种即插即用的多智能体框架,通过协作构建结构化认知地图作为空间记忆,无需修改架构或额外训练即可增强预训练多模态大模型的空间理解能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11548 2026-06-11 cs.CV 版本更新 57%

How Auxiliary Reasoning Unleashes GUI Grounding in VLMs

辅助推理如何释放VLM中的GUI定位能力

Weiming Li, Yan Shao, Jing Yang, Yujing Lu, Ling Zhong, Yuhan Wang, Min Yu, Tongxiao Ruan, Manni Duan

机构 * Zhejiang Lab(浙江实验室) Hangzhou Research and Development Center(杭州研发中心) China Mobile(中国移动) Innovation Center of Yangtze River Delta(长江三角洲创新中心) Zhejiang University(浙江大学)

专题命中 空间理解 :spatial understanding(abstract);分类 cs.CV

AI总结 针对VLM在GUI定位任务中隐式空间理解强但显式坐标输出弱的问题,提出三种零样本辅助推理方法(如标记网格),通过输入图像添加空间线索,显著提升定位性能,在多个基准上达到接近最优微调方法的效果。

详情

展开后加载摘要…

URL PDF HTML 收藏

6. SLAM与定位 2 篇

2505.10018 2026-06-11 cs.RO 版本更新 79%

LEMON-Mapping: Loop-Enhanced Large-Scale Multi-Session Point Cloud Merging and Optimization for Globally Consistent Mapping

LEMON-Mapping: 面向全局一致建图的环路增强大规模多会话点云融合与优化

Lijie Wang, Xiaoyi Zhong, Ziyi Xu, Kaixin Chai, Anke Zhao, Tianyu Zhao, Changjian Jiang, Qianhao Wang, Xieyuanli Chen, Fei Gao

机构 * Institute of CyberSystems and Control, Zhejiang University(浙江大学控制系统研究所) The Huzhou Institute, Zhejiang University(浙江大学湖州研究院) The State Key Laboratory of Industrial Control Technology, College of Control Science and Engineering, Zhejiang University(浙江大学控制科学与工程学院国家工业控制技术重点实验室) The College of Intelligence Science and Technology, National University of Defense Technology(国防科技大学智能科学与技术学院)

专题命中 SLAM与定位 :point cloud(title,abstract);分类 cs.RO

AI总结 提出LEMON-Mapping框架,通过鲁棒环路处理、空间光束法平差和基于PGO的优化,解决多机器人建图中重叠区域发散和模糊问题,实现高精度全局一致点云融合。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11880 2026-06-11 cs.CV 新提交 57%

SG2Loc: Sequential Visual Localization on 3D Scene Graphs

SG2Loc: 基于3D场景图的顺序视觉定位

Nicole Damblon, Olga Vysotska, Federico Tombari, Marc Pollefeys, Daniel Barath

机构 * ETH Zurich(苏黎世联邦理工学院) Google(谷歌) TU Munich(慕尼黑工业大学) Microsoft(微软)

专题命中 SLAM与定位 :point cloud(abstract);分类 cs.CV

AI总结 提出一种轻量级顺序视觉定位方法,利用紧凑的3D场景图表示环境,通过粒子滤波和语义匹配实现高效定位,显著降低存储需求。

Comments The code will be available at https://github.com/DmblnNicole/sg2loc

详情

展开后加载摘要…

URL PDF HTML 收藏