arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-08-21 至 2026-08-21 共收录 4 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 2 篇

2603.22531 2026-08-21 cs.CV 版本更新 57%

UrbanVGGT: Scalable Sidewalk Width Estimation from Street View Images

UrbanVGGT:从街景图像中可扩展的人行道宽度估计

Kaizhen Tan, Fan Zhang

机构 * Heinz College of Information Systems and Public Policy(信息系统与公共政策学院) Carnegie Mellon University(卡内基梅隆大学) Institute of Remote Sensing and Geographical Information System(遥感与地理信息系统研究所)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 本文提出UrbanVGGT方法,通过单张街景图像估算人行道宽度,结合语义分割、3D重建、地面平面拟合等技术,在华盛顿特区基准测试中达到0.252米的均方误差,展示了其在大规模城市中的可行性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02088 2026-08-21 cs.CV 版本更新 57%

PhysSFI-Net: Physics-informed Geometric Learning of Skeletal and Facial Interactions for Orthognathic Surgical Outcome Prediction

PhysSFI-Net:基于物理的几何学习用于正颌手术结果预测的颅面和面部相互作用

Jiahao Bao, Huazhen Liu, Yu Zhuang, Leran Tao, Xinyu Xu, Yongtao Shi, Mengjia Cheng, Yiming Wang, Congshuang Ku, Ting Zeng, Yilang Du, Siyi Chen, Shunyao Shen, Suncheng Xiang, Hongbo Yu

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

AI总结 PhysSFI-Net通过结合物理指导的几何深度学习,实现高精度的正颌手术术后面部形态预测,优于现有方法。

Comments 16 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

2. Gaussian Splatting 1 篇

2608.18388 2026-08-21 cs.CV 版本更新 83%

Depth Anything V4: Dynamic 4D Scene Reconstruction via Riemannian Flow Matching on 4D Gaussian Splatting

Depth Anything V4:基于4D高斯溅射的黎曼流匹配的动态4D场景重建

Jiaming Fan, Jian Lu, Jinling Jia, Chenbin Zhang

机构 * College of Artificial Intelligence, Nanjing University of Posts and Telecommunications(南京邮电大学人工智能学院) College of Automation, Nanjing University of Posts and Telecommunications(南京邮电大学自动化学院)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);分类 cs.CV

AI总结 本研究提出DAV4框架,将RFM应用于4D高斯溅射参数实现动态4D场景重建,其F分数较基线提升0.044,在相关任务上优于现有模型且无需人工标注深度标签。

Comments Major errors in research

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 空间理解 1 篇

2510.14357 2026-08-21 cs.RO cs.AI 版本更新 83%

SUM-AgriVLN: Spatial Understanding Memory for Agricultural Vision-and-Language Navigation

SUM-AgriVLN:面向农业视觉语言导航的空间理解记忆

Xiaobei Zhao, Xingqi Lyu, Xin Chen, Xiang Li

机构 * China Agricultural University(中国农业大学)

专题命中 空间理解 :spatial understanding(title,abstract);3D reconstruction(abstract);分类 cs.RO

AI总结 针对现有农业视觉语言导航方法忽视重复指令的空间记忆潜力的局限,提出SUM模块并集成至AgriVLN构建SUM-AgriVLN,在A2A基准上将SR从0.47提至0.54,NE仅微增,达领域顶尖性能。

详情

展开后加载摘要…

URL PDF HTML 收藏