arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-06-25 至 2026-06-25 共收录 19 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 4 篇

2601.22615 2026-06-25 cs.CV 版本更新 79%

TTSA3R: Training-Free Temporal-Spatial Adaptive Persistent State for Streaming 3D Reconstruction

TTSA3R:面向流式3D重建的无训练时-空自适应持久状态

Zhijie Zheng, Xinhao Xiang, Jiawei Zhang

机构 * University of California, Davis(加州大学戴维斯分校)

专题命中 三维重建 :3D reconstruction(title,abstract);分类 cs.CV

AI总结 提出无训练框架TTSA3R,通过时间状态演化与空间观测质量实现自适应状态更新,解决流式3D重建中的灾难性遗忘问题,在长序列上显著提升稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25430 2026-06-25 cs.CV 新提交 74%

PRISM: Feed-Forward Single-Image 3D Reconstruction via Geometric Warp-Residual Modeling

PRISM: 基于几何扭曲残差建模的前馈式单图像三维重建

Zhijie Zheng, Xinhao Xiang, Jiawei Zhang

机构 * University of California, Davis(加州大学戴维斯分校)

专题命中 三维重建 :3D reconstruction(title);分类 cs.CV

AI总结 提出PRISM前馈框架,将多视角潜在预测分解为无参数几何先验和可学习残差校正,无需扩散采样,推理时间仅36秒/场景,重建质量与扩散方法相当。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25284 2026-06-25 cs.CV 新提交 57%

Evaluation Protocols and Validation for Cameras in Indoor Healthcare Monitoring

室内医疗监测中摄像头的评估协议与验证

Amirhossein Dadashzadeh, Jingjing Liu, Qianhui Men, Qiushuo Cheng, Kirsty Scott, Lisa Alcock, Ian Craddock, Majid Mirmehdi

机构 * 1 School of Engineering Mathematics Technology, University of Bristol, UK 2 School of Computer Science, University of Bristol, UK 3 Translational Clinical Research Institute, Faculty of Medical Sciences, Newcastle University, UK 4 NIHR Newcastle Biomedical Research Centre, Newcastle University The Newcastle upon Tyne Hospitals NHS Foundation Trust, UK

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 提出两种技术验证协议,系统评估五款摄像头在可控室内条件下的计量性能和人体姿态估计支持能力,为医疗监测中的摄像头选型提供依据。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14915 2026-06-25 cs.CV 版本更新 57%

ILV: Iterative Latent Volumes for Fast and Accurate Sparse-View CT Reconstruction

ILV: 用于快速准确稀疏视角CT重建的迭代潜在体

Seungryong Lee, Woojeong Baek, Joosang Lee, Eunbyung Park

机构 * Sungkyunkwan University(成均馆大学) Yonsei University(延世大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 提出迭代潜在体(ILV)框架,结合数据驱动先验与经典迭代重建原理,通过构建并迭代更新显式3D潜在体,实现稀疏视角CBCT的快速高精度重建,在约14,000个CT体积的大规模数据集上显著优于现有方法。

Comments Project page: https://sngryonglee.github.io/ILV/

详情

展开后加载摘要…

URL PDF HTML 收藏

2. NeRF 1 篇

2603.28090 2026-06-25 cs.CV 版本更新 90%

To View Transform or Not to View Transform: NeRF-based Pre-training Perspective

视图变换还是不视图变换:基于NeRF的预训练视角

Hyeonjun Jeong, Juyeb Shin, Dongsuk Kum

机构 * KAIST(韩国科学技术院)

专题命中 NeRF :NeRF(title,title_cn);分类 cs.CV

AI总结 提出NeRP3D检测器,避免视图变换与NeRF的冲突先验,保留预训练NeRF网络,实现连续3D表示学习,在nuScenes上提升场景重建和检测性能。

Comments The Fourteenth International Conference on Learning Representations (ICLR'26)

详情

展开后加载摘要…

URL PDF HTML 收藏

3. Gaussian Splatting 6 篇

2509.19297 2026-06-25 cs.CV 版本更新 87%

VolSplat: Rethinking Feed-Forward 3D Gaussian Splatting with Voxel-Aligned Prediction

VolSplat: 重新思考基于体素对齐预测的前馈式3D高斯泼溅

Weijie Wang, Yeqing Chen, Zeyu Zhang, Hengyu Liu, Haoxiao Wang, Zhiyuan Feng, Wenkang Qin, Feng Chen, Jia-Wang Bian, Zheng Zhu, Donny Y. Chen, Bohan Zhuang

机构 * Zhejiang University(浙江大学) GigaAI University of Electronic Science and Technology of China(电子科技大学) The Chinese University of Hong Kong(香港中文大学) Tsinghua University(清华大学) The University of Adelaide(阿德莱德大学) Nanyang Technological University(南洋理工大学) Monash University(莫纳什大学)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract,abstract_cn);novel view synthesis(abstract);分类 cs.CV

AI总结 针对前馈式3D高斯泼溅中像素对齐预测的局限性,提出体素对齐的VolSplat方法,通过从预测的3D体素网格直接预测高斯,实现鲁棒的多视图一致性和更优的几何与渲染质量。

Comments ECCV 2026, Project Page: https://lhmd.top/volsplat, Code: https://github.com/ziplab/VolSplat

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.00206 2026-06-25 cs.CV cs.LG eess.IV 版本更新 87%

SparseGS: Sparse View Synthesis using 3D Gaussian Splatting

SparseGS: 使用3D高斯泼溅的稀疏视角合成

Haolin Xiong, Sairisheek Muttukuru, Hanyuan Xiao, Rishi Upadhyay, Pradyumna Chari, Yajie Zhao, Achuta Kadambi

机构 * University of California, Los Angeles(加州大学洛杉矶分校) University of Southern California(南加州大学) USC Institute for Creative Technologies(南加州大学创意技术研究所)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract,abstract_cn);novel view synthesis(abstract);分类 cs.CV

AI总结 针对3D高斯泼溅在稀疏视角下出现伪影的问题,提出SparseGS,通过深度先验、新颖深度渲染、剪枝启发和未见视角正则化模块,实现高质量重建。

Comments Version accepted to 3DV 2025. Project page: https://github.com/ForMyCat/SparseGS

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00989 2026-06-25 cs.CV 85%

Towards Integrating Multi-Spectral Imaging with Gaussian Splatting

迈向多光谱成像与高斯点扩散的整合

Josef Grün, Lukas Meyer, Maximilian Weiherer, Bernhard Egger, Marc Stamminger, Linus Franke

机构 * Visual Computing Erlangen, Friedrich-Alexander-Universität Erlangen-Nürnberg, Germany(埃朗根视觉计算,埃朗根-纽伦堡弗里德里希-亚历山大大学,德国)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract);3D reconstruction(abstract);分类 cs.CV

AI总结 本文研究如何将颜色(RGB)和多光谱成像(红、绿、红边和近红外)整合到3D高斯点扩散框架中,通过三种策略验证了联合优化的有效性,提升了多光谱重建质量。

Comments for project page, see https://meyerls.github.io/towards_multi_spec_splat/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11575 2026-06-25 cs.RO cs.AI cs.CV 版本更新 81%

ReaDy-Go: Real-to-Sim Dynamic 3D Gaussian Splatting Simulation for Environment-Specific Visual Navigation with Moving Obstacles

ReaDy-Go: 面向动态障碍物环境特定视觉导航的实到仿动态3D高斯泼溅仿真

Seungyeon Yoo, Youngseok Jang, Dabin Kim, Youngsoo Han, Seungwoo Jung, H. Jin Kim

机构 * Department of Aerospace Engineering, Seoul National University(首尔国立大学航空航天工程系) InnoCORE AI-Transformed Aerospace Research Center, KAIST(韩国科学技术院(KAIST)人工智能赋能航空航天研究中心)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);分类 cs.CV、cs.RO

AI总结 提出ReaDy-Go仿真管线,通过将静态3D高斯场景与动态人体高斯障碍物结合生成逼真动态场景,并训练导航策略,有效缩小仿真到现实的差距并处理移动障碍物。

Comments Accepted by IEEE Robotics and Automation Letters (RA-L). Project page: https://syeon-yoo.github.io/ready-go-site/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17796 2026-06-25 cs.CV cs.AI 版本更新 70%

CustomX: Unified Character, Action, and Scene Customization in Video World Models

CustomX: 视频世界模型中的统一角色、动作与场景定制

Yitong Wang, Fangyun Wei, Hongyang Zhang, Bo Dai, Yan Lu

机构 * Fudan University(复旦大学) Microsoft Research(微软研究院) University of Waterloo(滑铁卢大学) The University of Hong Kong(香港大学)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);分类 cs.CV

AI总结 提出CustomX,结合静态世界生成与可控实体模型,支持用户指定角色在3D场景中执行开放动作,通过条件自回归视频生成保持视觉保真度。

Comments Accepted to ECCV 2026. Project page: https://snowflakewang.github.io/CustomX_Page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05354 2026-06-25 cs.CV cs.GR 版本更新 62%

SplatPainter: Interactive Authoring of 3D Gaussians from 2D Edits via Test-Time Training

SplatPainter: 通过测试时训练从2D编辑交互式创作3D高斯

Yang Zheng, Hao Tan, Kai Zhang, Peng Wang, Leonidas Guibas, Gordon Wetzstein, Wang Yifan

机构 * Stanford University(斯坦福大学) Adobe

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV、cs.GR

AI总结 提出SplatPainter,一种状态感知的前馈模型,通过测试时训练实现从用户2D视图连续编辑3D高斯资产,支持局部细节优化、涂改和全局重着色,达到交互速度。

Comments project page https://y-zheng18.github.io/SplatPainter/

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 点云 5 篇

2606.25740 2026-06-25 cs.CV cs.AI 新提交 79%

Point Cloud Diffusion with Global and Local Reconstruction for Instance-Level 3D Anomaly Detection

基于全局与局部重建的点云扩散用于实例级3D异常检测

Linchun Wu, Qin Zou, Jiwen Lu, Qingquan Li

机构 * School of Computer Science, Wuhan University(武汉大学计算机学院) Department of Automation, Tsinghua University(清华大学自动化系) Guangdong Artificial Intelligence and Digital Economy Laboratory (SZ)(广东人工智能与数字经济实验室(深圳))

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 提出PCDiff框架,通过实例级多模态条件生成弱缺陷异常,并采用联合局部-全局重建算法恢复前景缺陷同时保持背景正常结构,在3D异常检测中显著优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03211 2026-06-25 cs.CV cs.NI eess.SP 交叉投稿 79%

Channel-adaptive Cross-modal Generative Semantic Communication for Point Cloud Transmission

面向点云传输的信道自适应跨模态生成式语义通信

Wanting Yang, Zehui Xiong, Qianqian Yang, Ping Zhang, Merouane Debbah, Rahim Tafazolli

机构 * IEEE

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 提出GenSeC-PC框架,通过跨模态语义编码融合图像与点云,结合信道自适应联合编解码和扩散模型加速,实现低信噪比下的鲁棒点云传输。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25278 2026-06-25 cs.CV cs.AI 新提交 57%

Heterogeneous and Adept Snapshot Distillation for 3D Semantic Segmentation

异构与专长快照蒸馏用于3D语义分割

Xiaopei Wu, Yuenan Hou, Junkai Xu, Wenxiao Wang, Binbin Lin, Yu Li, Ping Li, Haifeng Liu, Deng Cai, Wanli Ouyang

机构 * Shanghai AI Laboratory(上海人工智能实验室) Zhejiang University(浙江大学) Hangzhou Dianzi University(杭州电子科技大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 提出异构和专长快照知识蒸馏(HAS-KD),通过信息导向异构蒸馏(IHD)和专长快照蒸馏(ASD)将多模态模型和多个模型专家的知识高效迁移到点云网络,在ScanNetV2和S3DIS上取得最先进结果。

Comments 11 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25222 2026-06-25 cs.RO 新提交 57%

Swazure: Swarm Measurement of Pose for Flying Light Specks

Swazure: 飞行光点的群体姿态测量

Hamed Alimohammadzadeh, Shahram Ghandeharizadeh

机构 * University of Southern California(南加州大学)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 针对飞行光点(FLS)在传感器最佳范围外无法相互跟踪的问题,提出Swazure方法,通过FLS间协作解决缺失传感器数据,实现物理数据独立性,并引入两种启发式算法处理遮挡。

Comments Appeared in Proceedings of the Holodecks Foundation, Vol. 2, No. 3

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25194 2026-06-25 math.AT cs.CG math-ph math.MP quant-ph 新提交 50%

Hodge Spectral Surrogates for Topology-Constrained Optimization

用于拓扑约束优化的霍奇谱替代方法

Satoshi Kanno, Yoshi-aki Shimada

专题命中 点云 :point cloud(abstract)

AI总结 提出基于霍奇谱松弛的微分框架,通过低通谱滤波器实现拓扑约束优化,克服贝蒂数和持续同调的离散组合困难。

Comments 63 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 新视角合成 1 篇

2606.25427 2026-06-25 cs.CV 新提交 90%

Gastroendoscopy View Synthesis: A New Real Dataset and Evaluation

胃内镜视图合成:一个新的真实数据集与评估

Masaki Minai, Yusuke Monno, Masatoshi Okutomi, Sho Suzuki

机构 * Department of Systems and Control Engineering, School of Engineering, Institute of Science Tokyo(东京科学大学工学院系统与控制工程系) Department of Gastroenterology, International University of Health and Welfare Ichikawa Hospital(国际医疗福祉大学市川医院消化内科)

专题命中 新视角合成 :3DGS(summary_cn,abstract);NeRF(abstract,abstract_cn);Gaussian Splatting(abstract);point cloud(abstract)

AI总结 为解决胃内镜新视角合成数据集不足的问题,提出首个真实胃镜数据集GastroNVS,并评估多种3DGS方法,为未来发展指明挑战。

Comments Accepted for EMBC 2026. Project page: http://www.ok.sc.e.titech.ac.jp/res/GastroNVS/GastroGS/

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 空间理解 1 篇

2603.14609 2026-06-25 cs.CV 版本更新 79%

GroundSet: A Cadastral-Grounded Dataset for Spatial Understanding with Vector Data

GroundSet: 基于地籍数据的空间理解向量数据集

Roger Ferrod, Maël Lecene, Krishna Sapkota, George Leifman, Vered Silverman, Genady Beryozkin, Sylvain Lobry

专题命中 空间理解 :spatial understanding(title,abstract);分类 cs.CV

AI总结 针对多模态大模型在遥感精细空间理解上的不足,提出基于地籍矢量数据的大规模数据集,含510k高分辨率图像和380万标注对象,通过指令微调基准验证,标准架构可掌握细粒度空间定位。

详情

展开后加载摘要…

URL PDF HTML 收藏

7. 其他3D视觉 1 篇

2603.19964 2026-06-25 cs.CV 版本更新 57%

2K Retrofit: Entropy-Guided Efficient Sparse Refinement for High-Resolution 3D Geometry Prediction

2K Retrofit: 熵引导的高效稀疏细化用于高分辨率3D几何预测

Tianbao Zhang, Zhenyu Liang, Zhenbo Song, Nana Wang, Xiaomei Zhang, Xudong Cai, Zheng Zhu, Kejian Wu, Gang Wang, Zhaoxin Fan

机构 * BUAA(北京航空航天大学) SJTU(上海交通大学) GigaAI XREAL NUST(南京理工大学) RUC(清华大学) NUDT(国防科技大学) UCAS(中国科学技术大学) BIBMS(北京工业大学)

专题命中 其他3D视觉 :3D vision(abstract);分类 cs.CV

AI总结 提出2K Retrofit框架,通过快速粗预测和基于熵的稀疏细化,在不修改基础模型的情况下实现高效2K分辨率几何预测,达到SOTA精度和速度。

Comments Accepted by ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏