arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-06-26 至 2026-06-26 共收录 16 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 3 篇

2602.04349 2026-06-26 cs.CV cs.AI 版本更新 57%

VecSet-Edit: Unleashing Pre-trained LRM for Mesh Editing from Single Image

VecSet-Edit:利用预训练的LRM进行单图像网格编辑

Teng-Fang Hsiao, Bo-Kai Ruan, Yu-Lun Liu, Hong-Han Shuai

机构 * National Yang Ming Chiao Tung University(国立阳明交通大学)

专题命中 三维重建 :Gaussian Splatting(abstract);分类 cs.CV

AI总结 本文提出VecSet-Edit,利用VecSet LRM进行单图像网格编辑,通过Mask引导的token播种和注意力对齐的token门控策略,结合漂移感知的token修剪和细节保留的纹理烘焙模块,实现高精度网格编辑。

Comments Accepted by SIGGRAPH 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17916 2026-06-26 cs.CV 版本更新 57%

EndoUFM: Utilizing Foundation Models for Monocular depth estimation of endoscopic images

EndoUFM:利用基础模型进行内窥镜图像的单目深度估计

Xinning Yao, Bo Liu, Bojian Li, Jingjing Wang, Jinghua Yue, Fugen Zhou

机构 * Image Processing Center, Beihang University(北京航空航天大学图像处理中心) State Key Laboratory of High-Efficiency Reusable Aerospace Transportation Technology(高效可重复航天运输技术国家重点实验室)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 提出EndoUFM框架,通过双基础模型和自适应微调策略(RVLoRA和Res-DSC)提升内窥镜图像单目深度估计性能,在多个数据集上达到最优。

Comments 12 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27365 2026-06-26 cond-mat.mtrl-sci cond-mat.mes-hall physics.app-ph 新提交 50%

3D Imaging of Complex Skyrmion and Hopf Topologies in an Extended Sample

扩展样品中复杂斯格明子与霍普夫子拓扑结构的三维成像

I. Binnie, H. Fang, B. Shearer, A. Grafov, N. Jenkins, Y. Shao, C. O'Leary, Y. Liao, T. Feggeler, A. Oh, S. Yazdi, J. Zou, B. Wang, E-E. Cating, S. A. Montoya, D. Shapiro, J. Miao, H. C. Kapteyn, M. M. Murnane

专题命中 三维重建 :3D reconstruction(abstract)

AI总结 利用矢量叠层断层扫描技术,首次实验揭示了Fe/Gd多层膜中扩展三维斯格明子晶格,包括畴壁形状、拓扑荷、螺旋度和霍普夫子指数,并观察到从表面Néel型到体块Bloch型扭曲螺旋度的转变。

Comments 36 pages, 11 figures (Main text 16 pages, 5 figures)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. NeRF 1 篇

2606.27305 2026-06-26 cs.CV 新提交 89%

Sculpting NeRF Geometry: Human-Preference Fine-Tuning of a 3D-Aware Face GAN

雕刻NeRF几何:基于人类偏好的3D感知人脸GAN微调

Archer Moore, Mingming Gong, Liam Hodgkinson

机构 * School of Mathematics and Statistics, The University of Melbourne(墨尔本大学数学与统计学院)

专题命中 NeRF :NeRF(title,title_cn);3D generation(abstract);分类 cs.CV

AI总结 提出直接对辐射场密度值进行人类偏好强化学习微调,无需网格或形状先验,显著改善3D人脸几何,在74.4%的成对比较中用户偏好微调后的几何。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. Gaussian Splatting 4 篇

2606.26754 2026-06-26 cs.CV 新提交 87%

Capacity-Controlled Multi-View Stylization of 3D Gaussian Splatting

容量控制的多视图3D高斯泼溅风格化

Zhihao Wen, Yixin Yang, Bojian Wu, Yang Zhou, Dani Lischinski, Daniel Cohen-Or, Hui Huang

机构 * Guangdong Provincial Key Laboratory of Visual Media and Multidimensional Intelligence, CSSE, Shenzhen University(广东省可视媒体与多维智能重点实验室,计算机科学与软件工程学院,深圳大学) Tencent Games(腾讯游戏) The Hebrew University of Jerusalem(耶路撒冷希伯来大学) Tel Aviv University(特拉维夫大学)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract,abstract_cn);novel view synthesis(abstract);分类 cs.CV

AI总结 提出基于最优传输的容量控制框架,通过半平衡最优传输和列容量约束解决多视图风格分配不稳定问题,实现跨视图一致的3D风格化。

Comments Accepted to ECCV 2026. Project page: https://vcc2310.github.io/SceneStyler/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27223 2026-06-26 cs.CV 新提交 83%

SatSplatDiff: Geometry-preserving generative refinement for high-fidelity satellite Gaussian Splatting

SatSplatDiff: 用于高保真卫星高斯泼溅的几何保持生成式精化

Jiyong Kim, Shuang Song, Ronjgun Qin

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3D reconstruction(abstract);分类 cs.CV

AI总结 提出SatSplatDiff方法,通过单目深度监督、多尺度几何精化和阴影引导的生成式精化,在保持几何一致性的同时提升卫星高斯泼溅的视觉保真度,在IARPA2016和DFC2019数据集上实现几何MAE降低18%、视觉保真度提升28-45%。

Comments 23 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26236 2026-06-26 eess.IV cs.CV eess.SP 新提交 79%

Rendering Novel Views of MRI Using 3D Gaussian Splatting

使用3D高斯泼溅渲染MRI的新视图

Robin Y. Park, Mark C. Eid, Rhydian Windsor, Amir Jamaludin, Ana I. L. Namburete, João F. Henriques, Andrew Zisserman

机构 * Visual Geometry Group, University of Oxford(视觉几何组,牛津大学) Oxford Machine Learning in NeuroImaging Lab, University of Oxford(牛津大学神经影像学机器学习实验室)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);分类 cs.CV

AI总结 通过3D高斯泼溅从稀疏各向异性MRI重建体积并采样与目标解剖对齐的平面,生成更优的放射学分级视图,相比原始扫描和体素插值方法提高了椎管狭窄分级准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10446 2026-06-26 cs.CV 版本更新 57%

SignSparK: Efficient Multilingual Sign Language Production via Sparse Keyframe Learning

SignSparK: 通过稀疏关键帧学习实现高效多语言手语生成

Jianhe Low, Alexandre Symeonidis-Herzig, Maksym Ivashechkin, Ozge Mercanoglu Sincan, Richard Bowden

机构 * CVSSP, University of Surrey, United Kingdom(CVSSP,萨里大学,英国)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV

AI总结 提出SignSparK框架,利用稀疏关键帧和条件流匹配生成流畅3D手语序列,缓解回归到均值问题,支持多语言和关键帧到姿态编辑,实现最先进性能。

Comments Accepted at European Conference on Computer Vision (ECCV) 2026. Project page available: https://cogvis-cvssp.github.io/papers/signspark/

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 点云 6 篇

2606.26700 2026-06-26 cs.RO cs.AI 新提交 74%

Learning Motion Feasibility from Point Clouds in Cluttered Environments

从杂乱环境中的点云学习运动可行性

Sajid Ansari, Arthi, Girish Varma, Antony Thomas

机构 * International Institute of Information Technology Hyderabad(国际信息技术学院海得拉巴)

专题命中 点云 :point cloud(title);分类 cs.RO

AI总结 提出直接从RGB-D观测学习7自由度机械臂运动可行性预测的方法,构建包含270万抓取可行性标签的大规模基准,并评估三种分类器架构,最佳模型GRASPFC-PTX在新型物体上AUROC达0.996且预测速度远超基于采样的运动规划器。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26928 2026-06-26 cs.RO cs.SI 新提交 57%

UAV-MapFusion: RTK-Aligned Uncertainty-Aware Coarse-to-Fine Multi-Session UAV Mapping

UAV-MapFusion: RTK对齐的不确定性感知粗到细多会话无人机建图

Feng Pan, Chunran Zheng, Bing Xue, Yukang Cui, Jiayu Wen, Zhiyu Chen, Wei Wang

机构 * College of Automation, Harbin Engineering University(哈尔滨工程大学自动化学院) Department of Mechanical Engineering, University of Hong Kong(香港大学机械工程系) College of Mechatronics and Control Engineering, Shenzhen University(深圳大学机电与控制工程学院)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 提出一种不确定性感知的多会话点云地图合并与粗到细优化系统,通过RTK时空对齐和迭代平面因子优化,在抑制长距离漂移的同时保持局部几何精度。

Comments 8 pages, 5 figures, accepted by IEEE Robotics and Automation Letters (RA-L)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18254 2026-06-26 cs.CV 版本更新 57%

UniFlow: Zero-Shot LiDAR Scene Flow for Autonomous Vehicles

UniFlow: 自动驾驶车辆的零样本激光雷达场景流

Siyi Li, Qingwen Zhang, Ishan Khatri, Kyle Vedder, Eric Eaton, Deva Ramanan, Neehar Peri

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 提出UniFlow,一种跨多数据集训练的激光雷达场景流前馈模型,无需架构修改即可泛化到未见传感器,在Waymo和nuScenes上分别提升5.1%和35.2%,并在TruckScenes和AEVAScenes上超越先前数据集专用模型30.1%和22.5%。

Comments This work has been accepted to the European Conference on Computer Vision (ECCV) 2026. Project Page: https://lisiyi777.github.io/UniFlow/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26567 2026-06-26 eess.SP 新提交 50%

Multi-Modal Environment-Aware Beam Management for Massive MIMO: A Geometry-Driven Virtual Base Station Framework

大规模MIMO的多模态环境感知波束管理:一种几何驱动的虚拟基站框架

Yijie Bian, Wei Guo, Jie Yang, Shenghui Song, Jun Zhang, Shi Jin, Khaled B. Letaief

专题命中 点云 :point cloud(abstract)

AI总结 提出几何驱动框架,利用3D LiDAR点云和位置信息构建虚拟基站数据库,通过镜像对称建模主导反射路径,实现粗信道重建和低开销波束训练,并采用双智能体深度强化学习协调波束选择,提升波束管理效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26645 2026-06-26 cs.MM 新提交 50%

An Evaluation of Decentralized Group Formation Techniques for Flying Light Specks

飞行光点去中心化编队技术的评估

Hamed Alimohammadzadeh, Heather Culbertson, Shahram Ghandeharizadeh

专题命中 点云 :point cloud(abstract)

AI总结 本文评估了四种去中心化编队技术,用于飞行光点(FLS)的3D显示,发现随机子集(RS)技术在小规模编队(G≤5)中表现最优,而最近可用邻居优先(CANF)技术在大规模编队(G≥10)中表现更佳。

Comments Appeared in ACM Multimedia Asia 2023 (MMAsia '23), December 06-08, 2023, Tainan, Taiwan. ACM, New York, NY, USA, 7 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08987 2026-06-26 cs.CR cs.MM cs.NI eess.IV 版本更新 50%

ABE-VVS: Attribute-Based Encrypted Volumetric Video Streaming

ABE-VVS:基于属性的加密体积视频流

Mohammad Waquas Usmani, Susmit Shannigrahi, Michael Zink

专题命中 点云 :point cloud(abstract)

AI总结 提出ABE-VVS框架,通过选择性加密点云坐标实现轻量级DRM,降低计算开销和延迟,实验表明仅加密X坐标可减少50%加密时间和80%解密时间,并实现零缓冲。

Comments Version 2: Extended to include experiments with RAM-based caching. The manuscript now contains 11 pages and 7 figures (including subfigures)

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 新视角合成 1 篇

2606.23027 2026-06-26 cs.CV 新提交 83%

Learning Stable Canonical Worlds for Novel View Synthesis and Beyond

学习稳定规范世界用于新视角合成及更多应用

Xiaoyu Xu, Jian Zou, Sheyang Tang, Zhihua Wang, Jing Liao, Kede Ma

机构 * City University of Hong Kong(香港城市大学) University of Waterloo(滑铁卢大学)

专题命中 新视角合成 :novel view synthesis(title,abstract);Gaussian Splatting(abstract);分类 cs.CV

AI总结 提出CanonicalGS,一种前馈高斯泼溅管道,通过不确定性感知融合将多视图观测映射到稳定场景表示,提升新视角合成质量并迁移到下游视觉任务。

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 其他3D视觉 1 篇

2606.26894 2026-06-26 cs.CV 新提交 57%

Modeling Local, Global, and Cross-Modal Context in Multimodal 3D MRI

多模态3D MRI中的局部、全局和跨模态上下文建模

Minh Duc Do, Tillmann Rheude, Noel Kronenberg, Roland Eils, Benjamin Wild

机构 * Berlin Institute of Health at Charité - Universitätsmedizin Berlin(柏林健康研究所,柏林夏里特医学院) Health Data Science Unit, Heidelberg University Hospital and BioQuant(海德堡大学医院与BioQuant健康数据科学部) Intelligent Medicine Institute, Fudan University(复旦大学智能医学研究所) Department of Mathematics and Computer Science, Freie Universität Berlin(柏林自由大学数学与计算机科学系)

专题命中 其他3D视觉 :3D vision(abstract);分类 cs.CV

AI总结 提出MICViT,一种3D视觉Transformer,通过四种注意力机制显式建模模态内和跨模态的局部与全局交互,在多数据集脑龄预测任务中优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏