arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-08-19 至 2026-08-19 共收录 7 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 2 篇

2604.20784 2026-08-19 cs.CV 版本更新 83%

GeoRect4D: Geometry-Compatible Generative Rectification for Dynamic Sparse-View 3D Reconstruction

GeoRect4D:几何兼容的生成性矩形化用于动态稀疏视角3D重建

Zhenlong Wu, Zihan Zheng, Xuanxuan Wang, Lei Huang, Hongwei Hu, Xiaoyun Zhang, Qiang Hu, Wenjun Zhang

机构 * Shanghai Jiao Tong University(上海交通大学)

专题命中 三维重建 :3D reconstruction(title);3DGS(abstract,abstract_cn);分类 cs.CV

AI总结 本文提出GeoRect4D框架,通过闭环优化结合显式3D一致性与生成性细化,解决动态稀疏视角3D重建中的几何崩溃和漂移问题,提升重建精度与时间一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18005 2026-08-19 cs.CV 版本更新 57%

UrbanWorld2.0: A Multimodal Agentic Framework for Reality-Aligned 3D World Generation at City-Scale

RAISECity: 一种用于城市级现实对齐3D世界生成的多模态代理框架

Shengyuan Wang, Zhiheng Zheng, Yu Shang, Lixuan He, Yangcheng Yu, Fan Hangyu, Jie Feng, Qingmin Liao, Yong Li

机构 * College of AI, Tsinghua University(人工智能学院,清华大学) Shenzhen International Graduate School, Tsinghua University(深圳国际研究生院,清华大学) Department of Electronic Engineering, BNRist, Tsinghua University(电子工程系,北京研究院,清华大学)

专题命中 三维重建 :3D generation(abstract);分类 cs.CV

AI总结 RAISECity通过多模态代理框架实现城市级3D世界生成,提升现实对齐、精度和性能,适用于沉浸媒体和具身智能应用。

Comments Accepted by ACM MM 2026, the code is available at: this https URL (https://github.com/tsinghua-fib-lab/UrbanWorld2.0)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. Gaussian Splatting 1 篇

2608.10938 2026-08-19 cs.CV 版本更新 87%

GS-CPE: Unified 6-Degree-of-Freedom Camera Pose Estimation via 3D Gaussian Splatting

GS-CPE:基于3D高斯溅射的统一6自由度相机位姿估计

Huaiyuan Weng, Chul Min Yeum, Su-Min Kang

机构 * University of Waterloo(滑铁卢大学) Soongsil University(崇实大学)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract,abstract_cn);分类 cs.CV

AI总结 该研究提出GS-CPE框架,通过由粗到细策略统一几何粗位姿估计与3D高斯溅射精调,在多数据集上实现最优视觉定位性能,兼顾精度与泛化能力。

Comments 8 pages, accepted at IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 点云 2 篇

2608.08115 2026-08-19 cs.CV 版本更新 79%

SUMI: Scalable Unified Model for 3D Point Cloud Inference

SUMI:用于三维点云推理的可扩展统一模型

Yanlong Li, Kanchana Thilakarathna

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 针对点云补全由粗到精范式中局部细节重构不足的问题,提出扩散增强细化模块SUMI,可集成到现有模型,在多个基准数据集上实现性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28927 2026-08-19 quant-ph cs.CG math.AT 版本更新 50%

Quantum encodings that preserve persistent homology

保持持续同调的量子编码

Arthur J. Parzygnat, Andrew Vlasic

专题命中 点云 :point cloud(abstract)

AI总结 研究在量子拓扑数据分析中,哪些量子编码能最好地保留原始数据集的拓扑不变量,并提出直接作用于数据的编码方案。

Comments Comments are welcome! v2: removed disclaimer and affiliation

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 3D生成 2 篇

2603.22782 2026-08-19 cs.CV 版本更新 79%

Know3D: Prompting 3D Generation with Knowledge from Vision-Language Models

Know3D: 通过视觉-语言模型的知识提示3D生成

Wenyue Chen, Wenjue Chen, Peng Li, Qinghe Wang, Xu Jia, Heliang Zheng, Rongfei Jia, Yuan Liu, Ronggang Wang

机构 * Peking University(北京大学) Math Magic(数学魔术) The Hong Kong University of Science and Technology(香港科学与技术大学) Guangdong Provincial Key Laboratory of Ultra High Definition Immersive Media Technology(广东省超高清沉浸媒体技术重点实验室) Dalian University of Technology(大连理工大学)

专题命中 3D生成 :3D generation(title,abstract);分类 cs.CV

AI总结 本文提出Know3D框架,利用多模态大语言模型的知识提升3D生成的可控性,通过潜在状态注入实现语言可控的后视图生成,改进3D生成的几何细节与一致性。

Comments ECCV2026 page: this https URL (https://xishuxishu.github.io/Know3D.github.io/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.01586 2026-08-19 cs.RO cs.AI 版本更新 57%

ManiCM: Real-time 3D Diffusion Policy via Consistency Model for Robotic Manipulation

ManiCM:用于机器人操作的基于一致性模型的实时3D扩散策略

Zifeng Gao, Guanxing Lu, Tianxing Chen, Wenxun Dai, Ziwei Wang, Chao Shang, Wenbo Ding, Yansong Tang

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院,清华大学) Shanghai AI Laboratory(上海人工智能实验室) Nanyang Technological University(南洋理工大学)

专题命中 3D生成 :point cloud(abstract);分类 cs.RO

AI总结 该研究提出ManiCM模型,通过一致性约束实现一步推理,在31项机器人操作任务上,推理速度较最优方法提升10倍且保持竞争力。

Comments this https URL (https://manicm-fast.github.io/)

详情

展开后加载摘要…

URL PDF HTML 收藏